AudioHijack: скрытые команды через звук угрожают голосовым ИИ-ассистентам Microsoft и Mistral.
Рассказываем об атаке AudioHijack, которая позволяет скрытно внедрять вредоносные команды голосовым ИИ-ассистентам через аудиофайлы.
Исследователи из Китая и Сингапура выяснили, что специальный звуковой сигнал, подмешанный в музыку или речь, не слышен человеку, но модели распознают его и выполняют указания. Это открывает хакерам доступ к файлам, возможность утечки данных или переход по фишинговой ссылке.
Атака работает в реальных сценариях: подкаст, фон Zoom-звонка, ролик YouTube. Тесты на 13 моделях показали успех в 79–96% случаев. Уязвимость подтверждена на коммерческих платформах Microsoft и Mistral. Обучение атакующего сигнала занимает около получаса и после этого не зависит от окружающих шумов.
Защитные системы пока не детектируют такие инъекции. И это тревожит: раньше аудиомодели только транскрибировали речь, а теперь они глубоко интегрированы с почтовыми клиентами, браузерами и файловой системой.

