Назад
24 мая 2026 г. в 15:00 AI Security Voice Assistants Agents Cybernews; Wikimedia Commons

AI-ассистентов можно обмануть неслышными командами в видео и музыке

AI-ассистентов можно обмануть неслышными командами в видео и музыке

AI-ассистентов можно обмануть неслышными командами в видео и музыке

Голосовые AI-ассистенты получают новый, очень бытовой риск: команду можно спрятать не в тексте, а в звуке. Cybernews пишет о демонстрации, где скрытые аудиосигналы, встроенные в музыку, видео, подкаст или звонок, могут заставить помощника выполнить действие, хотя человек рядом ничего подозрительного не слышит.

По описанию издания, такие сигналы могут подталкивать ассистента к веб-поиску, загрузке файла или отправке письма. Важно не раздувать историю до паники: это выглядит как исследовательский сценарий и предупреждение о классе атак, а не как доказанная массовая кампания против домашних колонок. Но направление неприятное именно потому, что AI-помощники быстро перестают быть игрушкой для погоды и таймеров.

Почему голосовой агент опаснее старой колонки

Классические голосовые помощники были ограничены: включить музыку, поставить будильник, ответить на простой вопрос. Современный AI-ассистент постепенно получает больше прав. Он может искать информацию, читать документы, составлять письмо, управлять приложениями, работать с файлами, подключаться к календарю, CRM или домашней автоматизации. Чем больше у него инструментов, тем выше цена ложной команды.

Здесь появляется аудиоверсия prompt injection. В текстовых чатах уже давно обсуждают вредные инструкции, спрятанные на веб-странице, в документе или письме: модель читает их как часть задачи и может сбиться. В голосовом интерфейсе похожая идея переносится в среду, где пользователь хуже контролирует вход. Если команда звучит в ролике, рекламе, фоновой музыке или звонке, человек может даже не понять, что ассистент получил инструкцию.

Для обычного пользователя это особенно неприятно из-за привычки доверять голосу вокруг себя. Мы привыкли, что если команда не произнесена вслух человеком рядом, её как будто не было. AI-агент ломает эту интуицию: микрофон слышит больше, чем человек осознаёт, а модель пытается превратить сигнал в намерение.

Что должны менять платформы

Главная защита здесь не в том, чтобы запретить голосовые функции. Нужна другая архитектура доверия. Поиск справки можно выполнить сразу, но письмо, загрузка файла, покупка, отправка данных, изменение настроек и доступ к аккаунтам должны требовать явного подтверждения на экране или отдельной фразой. Ассистенту также нужен понятный журнал: какая команда была распознана, откуда пришёл звук и какое действие было запущено.

Разработчикам придётся отличать живой голос пользователя от фонового медиа, проверять подозрительные частоты и не давать агенту исполнять чувствительные команды только потому, что модель «услышала» уверенную инструкцию. Для корпоративных систем это ещё важнее: голосовой агент в переговорной, на ноутбуке или в колл-центре может иметь доступ к данным, которые нельзя отдавать на автопилот.

Эта история хорошо показывает, куда смещается безопасность AI. Раньше вопрос звучал так: «может ли модель неправильно ответить?» Теперь вопрос шире: «кто управляет моделью, когда она сама умеет действовать?» Если ассистент получает руки в виде инструментов, то любой вход — текст, картинка, сайт или звук — становится потенциальной командной строкой.

💬 Мнение редакции Neuro.ee

Голосовые агенты будут удобными только при одном условии: опасные действия должны подтверждаться человеком, а не угадываться моделью по шуму вокруг. Иначе самый слабый интерфейс в системе окажется не пароль, а включённый микрофон.

Ещё новости

Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой
7 октября 2026 г.
Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой

Georgia Tech получила одобрение на новую онлайн-магистратуру по искусственному интеллекту. Старт намечен на 2027 год: программа обещает шесть направлений и обязательный проект с компанией или организацией, но детали приёма и стоимости пока не раскрыты.

Mistral Large 4: API уже доступен, веса — в конце октября
6 октября 2026 г.
Mistral Large 4: API уже доступен, веса — в конце октября

Mistral открыла public preview Mistral Large 4 — мультимодальной модели с 1 трлн параметров, из которых активно 49 млрд. В API её уже можно попробовать, но обещанные open weights появятся лишь в конце октября.

Reflection показала Beam на 501 млрд параметров — но веса выйдут позже
6 октября 2026 г.
Reflection показала Beam на 501 млрд параметров — но веса выйдут позже

Reflection представила Beam — открытую по весам MoE-модель для кода, рассуждений и агентов. Пока это ранний доступ: веса, model card и технический отчёт обещаны лишь позднее в октябре.

OpenAI начнёт маркировать тексты ChatGPT и Codex в ЕС
6 октября 2026 г.
OpenAI начнёт маркировать тексты ChatGPT и Codex в ЕС

OpenAI сообщила, что будет добавлять невидимую маркировку в тексты ChatGPT и Codex для пользователей из ЕС. Метка должна помочь выполнять требования AI Act, но компания признаёт: после существенной правки текста её будет труднее обнаружить.

GitHub открыла API для запуска проверок кода Copilot
5 октября 2026 г.
GitHub открыла API для запуска проверок кода Copilot

GitHub разрешила запускать проверку pull request’ов Copilot через REST и GraphQL API. Одновременно для новых и уже существующих репозиториев стандартным уровнем тщательности стал Balanced.

AWS показала Well-Architected Agent: ИИ-ревизор для облака, но с правами и проверкой человеком
5 октября 2026 г.
AWS показала Well-Architected Agent: ИИ-ревизор для облака, но с правами и проверкой человеком

AWS открыла предварительный доступ к Well-Architected Agent — сервису, который анализирует инфраструктуру и предлагает исправления для стоимости, производительности, устойчивости и безопасности. Рекомендации могут включать изменения IaC, но AWS отдельно предупреждает: генеративный ИИ способен ошибаться.

Google урезает доступ к Gemini: бесплатным оставят Flash-Lite
4 октября 2026 г.
Google урезает доступ к Gemini: бесплатным оставят Flash-Lite

Google меняет набор моделей Gemini для бесплатных пользователей и подписки AI Plus. С 9 октября доступ к Pro исчезнет у обоих уровней, а платный AI Pro получит Deep Think.

Руководитель по безопасности OpenAI ушёл, назвав культуру компании сломанной
4 октября 2026 г.
Руководитель по безопасности OpenAI ушёл, назвав культуру компании сломанной

Дэвид Робинсон, руководивший подготовкой отчётов по безопасности к релизам OpenAI, покинул компанию. В эссе он заявил, что темп запусков не оставляет ей достаточной осторожности; OpenAI ответила, что продолжает усиливать практики безопасности и при необходимости замедляет обучение или выпуск моделей.

PFNYC: в Нью-Йорке сжимаются стартовые вакансии в профессиях, уязвимых для ИИ
4 октября 2026 г.
PFNYC: в Нью-Йорке сжимаются стартовые вакансии в профессиях, уязвимых для ИИ

В Нью-Йорке с 2022 года заметно сократилось число стартовых вакансий в нескольких офисных профессиях с высокой подверженностью ИИ, сообщает Partnership for New York City. Данные PFNYC и отдельная работа Stanford фиксируют совпадающие ранние паттерны, но не доказывают, что их причиной стал именно ИИ.

Фишинг под видом обсуждения ИИ-политики: как TA419 охотилась за доступом к Microsoft 365
4 октября 2026 г.
Фишинг под видом обсуждения ИИ-политики: как TA419 охотилась за доступом к Microsoft 365

Proofpoint описала кампанию TA419 против экспертов по ИИ-политике: злоумышленники начинали с правдоподобного письма, а после ответа вели жертву на поддельную страницу входа Microsoft.

GitHub Copilot получил доступ к настольным приложениям
4 октября 2026 г.
GitHub Copilot получил доступ к настольным приложениям

GitHub открыл preview режима Computer Use для Copilot CLI и приложения Copilot на macOS и Windows. Агент может работать с графическим интерфейсом, но перед управлением программой обязан запросить подтверждение.

За ИИ платят лишь 2,2% домохозяйств США — но чек растёт
3 октября 2026 г.
За ИИ платят лишь 2,2% домохозяйств США — но чек растёт

В отчёте a16z State of Markets II доля американских домохозяйств с платной AI-подпиской достигла 2,2% к весне 2026 года. Это не оценка всего рынка ИИ и не число пользователей: график фиксирует только оплачиваемые подписки домохозяйств, зато показывает одновременно рост проникновения и среднего ежемесячного чека.