AudioGuard: Toward Comprehensive Audio Safety Protection Across Diverse Threat Models

AudioGuard: Toward Comprehensive Audio Safety Protection Across Diverse Threat Models

AudioGuard: Auf dem Weg zu umfassendem Audiosicherheits-Schutz über verschiedene Bedrohungsmodelle hinweg

https://ift.tt/aJPZ4Bj

Audio hat sich rasch zu einer primären Schnittstelle für Foundation-Modelle entwickelt und treibt Echtzeit-Sprachassistenten an. Sicherheit in Audiosystemen zu gewährleisten ist inhärent komplexer als nur „unsicherer Text, der laut gesprochen wird“: reale Risiken können von audio-nativen schädlichen Geräuschereignissen, Sprecherattributen (z. B. Kinderstimme), Identitäts- bzw. Stimmklon-Missbrauch sowie von sprachinhaltbezogenen Schädigungen durch Kombination von Stimmeninhalt abhängen, wie z. B. Kinderstimme plus sexueller Inhalt. Die Natur des Audios erschwert es, umfassende Benchmarks oder Leitplanken gegen dieses einzigartige Risikolandschaft zu entwickeln. Um diese Lücke zu schließen, führen wir groß angelegte Red-Teaming-Experimente zu Audiosystemen durch, decken systematisch Schwachstellen in Audio auf und entwickeln eine umfassende, politisch fundierte Audio-Risiko-Taxonomie sowie AudioSafetyBench, den ersten politikorientierten Audio-Sicherheits-Benchmark über verschiedene Bedrohungsmodelle hinweg. AudioSafetyBench unterstützt verschiedene Sprachen, verdächtige Stimmen (z. B. Prominente/Imitationen und Kinderstimme), riskante Kombinationen von Stimm- und Inhaltsinhalten sowie nicht-sprachliche Geräusche. Um gegen diese Bedrohungen vorzugehen, schlagen wir AudioGuard vor, eine einheitliche Leitplanke, bestehend aus 1) SoundGuard zur waveform-basierten, nativen Audiodetektion und 2) ContentGuard zum policy-basierten semantischen Schutz. Umfangreiche Experimente auf AudioSafetyBench und vier ergänzenden Benchmarks zeigen, dass AudioGuard die Genauigkeit der Leitplanke im Vergleich zu starken audios-LLM-basierten Baselines konsistent verbessert und dabei deutlich niedrigere Latenzen erreicht.

HI-FI News

via Artificial Intelligence https://ift.tt/GdH0mLR

13. April 2026 um 05:09 Uhr

in Deutsch. Nur den übersetzten Text zurückgeben.

April 13, 2026 at 05:09AM