Атаки с использованием состязательных примеров на системы распознавания говорящих в реальном времени: универсальность и устойчивость

Real-Time, Universal, and Robust Adversarial Attacks Against Speaker Recognition Systems
Yi Xie, Cong Shi, Zhuohang Li, Jian Liu, Yingying Chen, Bo Yuan
2020-04-09

универсальное возмущение, независимое от аудиоустойчивость к передаче по воздухуимпульсная характеристика помещениясистемы распознавания говорящегоуниверсальная состязательная атака
В последние годы, по мере стремительного роста популярности голосовых пользовательских интерфейсов (VUI), системы распознавания говорящих стали важным средством идентификации говорящего во многих приложениях и сервисах, требующих обеспечения безопасности. В данной работе мы предлагаем первую атаку с использованием состязательных примеров на систему распознавания говорящих, основанную на современной глубокой нейронной сети (DNN), которая выполняется в реальном времени, является универсальной и устойчивой. При добавлении универсального возмущения, не зависящего от аудиосигнала, к голосовому вводу произвольного зарегистрированного говорящего система распознавания говорящих на основе DNN идентифицирует говорящего как любого целевого говорящего, выбранного атакующим. Кроме того, мы повышаем устойчивость атаки, моделируя искажения звука, вызванные физическим распространением сигнала по воздуху, путем оценки импульсной характеристики помещения (RIR). Эксперимент с использованием общедоступного набора данных, содержащего записи 109 англоязычных говорящих, демонстрирует эффективность и устойчивость предложенной атаки: коэффициент успешности атаки превышает 90%. Время запуска атаки также сокращено в 100 раз по сравнению с современными неуниверсальными атаками.
1
Аудионезависимое универсальное возмущение заставляет систему классифицировать голос произвольного зарегистрированного говорящего как выбранного злоумышленником целевого говорящего.
2
Эксперименты на открытом наборе данных со 109 англоязычными говорящими показали успешность атаки свыше 90%.
3
Представлена первая работа по атаке на современные системы распознавания говорящих на основе DNN, одновременно работающей в реальном времени, универсальной и устойчивой.
4
Моделирование физических искажений при распространении звука по воздуху с использованием оценённых импульсных характеристик помещения повышает устойчивость атаки.
5
Запуск атаки выполняется в 100 раз быстрее, чем у современных неуниверсальных атак.

системы распознавания говорящих на основе DNN, обрабатывающие голосовые входы произвольных зарегистрированных говорящих

эффективность, универсальность, работа в реальном времени и устойчивость к передаче по воздуху аудионезависимых универсальных состязательных возмущений, вызывающих целевую ошибочную идентификацию метки говорящего

Publication Details
Publication Date
2020-04-09
Journal
Publisher
ISSN
Access Type
Author Information
Authors
Yi Xie
Cong Shi
Zhuohang Li
Jian Liu
Yingying Chen
Bo Yuan
Explore further
Open the scid.ai AI chat with a ready-made request: it will find papers on a similar topic and help build a literature review.
Find similar papers in the chat
Make a presentation
100%