Атаки с использованием состязательных примеров на системы распознавания говорящих в реальном времени: универсальность и устойчивость
Real-Time, Universal, and Robust Adversarial Attacks Against Speaker Recognition Systems
2020-04-09
SCID: 54.1/xmat49ux
Discuss with AI
универсальное возмущение, независимое от аудиоустойчивость к передаче по воздухуимпульсная характеристика помещениясистемы распознавания говорящегоуниверсальная состязательная атака
Figures from the paper
Abstract (AI)
В последние годы, по мере стремительного роста популярности голосовых пользовательских интерфейсов (VUI), системы распознавания говорящих стали важным средством идентификации говорящего во многих приложениях и сервисах, требующих обеспечения безопасности. В данной работе мы предлагаем первую атаку с использованием состязательных примеров на систему распознавания говорящих, основанную на современной глубокой нейронной сети (DNN), которая выполняется в реальном времени, является универсальной и устойчивой. При добавлении универсального возмущения, не зависящего от аудиосигнала, к голосовому вводу произвольного зарегистрированного говорящего система распознавания говорящих на основе DNN идентифицирует говорящего как любого целевого говорящего, выбранного атакующим. Кроме того, мы повышаем устойчивость атаки, моделируя искажения звука, вызванные физическим распространением сигнала по воздуху, путем оценки импульсной характеристики помещения (RIR). Эксперимент с использованием общедоступного набора данных, содержащего записи 109 англоязычных говорящих, демонстрирует эффективность и устойчивость предложенной атаки: коэффициент успешности атаки превышает 90%. Время запуска атаки также сокращено в 100 раз по сравнению с современными неуниверсальными атаками.
Key Findings
1
Аудионезависимое универсальное возмущение заставляет систему классифицировать голос произвольного зарегистрированного говорящего как выбранного злоумышленником целевого говорящего.
2
Эксперименты на открытом наборе данных со 109 англоязычными говорящими показали успешность атаки свыше 90%.
3
Представлена первая работа по атаке на современные системы распознавания говорящих на основе DNN, одновременно работающей в реальном времени, универсальной и устойчивой.
4
Моделирование физических искажений при распространении звука по воздуху с использованием оценённых импульсных характеристик помещения повышает устойчивость атаки.
5
Запуск атаки выполняется в 100 раз быстрее, чем у современных неуниверсальных атак.
Research Object
системы распознавания говорящих на основе DNN, обрабатывающие голосовые входы произвольных зарегистрированных говорящих
Research Subject
эффективность, универсальность, работа в реальном времени и устойчивость к передаче по воздуху аудионезависимых универсальных состязательных возмущений, вызывающих целевую ошибочную идентификацию метки говорящего
Publication Details
Publication Date
2020-04-09
Journal
Publisher
ISSN
Access Type
Author Information
Download PDF
Subscribe to digest