Назад
28 сентября 2026 г. в 16:55 NVIDIA ИИ-агенты безопасность Open Source Источник

NVIDIA открыла платформу безопасности для ИИ-агентов

NVIDIA открыла платформу безопасности для ИИ-агентов

У ИИ-агента может быть прекрасный план — и всё равно не должно быть права обойти ограничение. NVIDIA представила Open Agent Safety Platform: открытую платформу и эталонную архитектуру, которые должны контролировать действия агента на уровне среды выполнения и инфраструктуры, а не полагаться только на инструкции в промпте.

В состав входят OpenShell и NVIDIA Sentry. По заявлению компании, Sentry работает отдельно от агента на DPU BlueField-4 — специализированном процессоре обработки данных — и способен изолировать процесс, если тот выходит за заданные рамки, за миллисекунды.

Ограничитель вне модели

OpenShell задаёт защищённую границу выполнения: отслеживает действия агента и применяет политики во время работы. Это важно для агентов, которым дают доступ к коду, внутренним системам, файлам или внешним сервисам: они могут ошибиться, попасть под prompt injection или попытаться завершить задачу способом, который нарушает правила.

NVIDIA подчёркивает, что OpenShell — открытое ПО. Его можно расширять для платформ Arm и Intel, а не только использовать на процессорах NVIDIA Vera. Однако Sentry в заявленной схеме привязан к BlueField-4, так что «полный стек» контроля требует конкретного оборудования NVIDIA.

Что меняется для команд

Обычная защита агента часто живёт рядом с ним: в системных инструкциях, правилах приложения или проверках перед вызовом инструмента. Новый подход пытается вынести наблюдателя за пределы этого контура. Агент не должен иметь возможности сам отключить механизм, который проверяет его права.

NVIDIA перечисляет среди участников и интеграционных партнёров Anthropic, Microsoft, Salesforce, SAP, Hugging Face и другие компании. Salesforce, например, планирует связать OpenShell со Slack, чтобы команды видели активность агента, аудит-события и могли одобрять дополнительные разрешения.

Открытость — не гарантия безопасности

Платформа не делает агента безопасным автоматически. Компании всё равно должны определить политики, права доступа и сценарии эскалации; плохое правило в аппаратно защищённой оболочке останется плохим правилом.

Но сама идея здравая: чем больше агенту доверяют реальную работу, тем важнее, чтобы последняя проверка была не его собственным рассуждением, а независимым техническим барьером. Исходный код OpenShell и документация уже доступны через ресурсы NVIDIA.

Источник: NVIDIA Newsroom

Ещё новости

NYT: правительства всё сильнее отстают от развития ИИ
28 сентября 2026 г.
NYT: правительства всё сильнее отстают от развития ИИ

The New York Times пишет, что разрыв между скоростью развития ИИ и скоростью выработки правил стал шире, чем когда-либо. Пока модели и агенты быстро выходят за пределы лабораторий, у мира нет общего механизма, который определял бы допустимый риск и ответственность.

Bloomberg: Китай расширил ограничения на поездки семей AI- и чип-специалистов
28 сентября 2026 г.
Bloomberg: Китай расширил ограничения на поездки семей AI- и чип-специалистов

Bloomberg сообщает, что Китай распространил ограничения на зарубежные поездки ключевых сотрудников частных AI- и полупроводниковых компаний на членов их семей. Публикация не подтверждает появление отдельной системы «выездных виз»: речь идёт о мерах контроля поездок, а не о визе, которую выдаёт другая страна.

Meta добавит в WhatsApp говорящий аватар для звонков с очков
26 сентября 2026 г.
Meta добавит в WhatsApp говорящий аватар для звонков с очков

Meta готовит Hologram — цифровое изображение лица для звонков из очков Meta Ray-Ban Display. Аватар будет реагировать на голос, но первый запуск ограничен ранним доступом в США.

Google добавила говорящие аватары в Gemini Enterprise
26 сентября 2026 г.
Google добавила говорящие аватары в Gemini Enterprise

Google открыла для Gemini Enterprise Live Avatar: корпоративный голосовой агент теперь может отвечать с синхронизированным видеоаватаром. Функция полезна для сервисных сценариев, но создание собственных персонажей пока требует allowlist.

Google Beam выходит в шесть стран: 3D-видеосвязь становится ближе к офисам
26 сентября 2026 г.
Google Beam выходит в шесть стран: 3D-видеосвязь становится ближе к офисам

Google расширяет поставки Beam — системы видеосвязи с эффектом присутствия — на шесть стран и запускает сеть демонстрационных переговорных. Важно не само обещание «как в одной комнате», а то, что устройство начинает появляться там, где его можно испытать до покупки.

Microsoft встраивает Word, Excel и PowerPoint в новый Copilot
26 сентября 2026 г.
Microsoft встраивает Word, Excel и PowerPoint в новый Copilot

Microsoft представила новый интерфейс Copilot: в нём объединяются чат и агентный режим, а документы Word, таблицы Excel и презентации PowerPoint можно создавать и править прямо из разговора. Первые функции доступны не всем: Home и Code начинают раскатывать в программе Frontier, а Autopilot пока идёт в закрытый предварительный доступ.

Gemini подключает Adobe, Airtable и Linear: ИИ добирается до списка дел
23 сентября 2026 г.
Gemini подключает Adobe, Airtable и Linear: ИИ добирается до списка дел

Google расширяет Connected Apps в Gemini: ассистент получает новые связки с Adobe, Airtable, Linear, Peloton и другими сервисами. Главный вопрос теперь не в количестве подключений, а в том, какие действия и данные пользователь готов отдать в один чат.

AWS запустила CloudWatch Omni для отладки ИИ-агентов
23 сентября 2026 г.
AWS запустила CloudWatch Omni для отладки ИИ-агентов

AWS представила CloudWatch Omni — отдельную среду наблюдаемости для приложений и ИИ-агентов. Сервис собирает трассы, метрики и логи в одном интерфейсе и позволяет расследовать сбои через чат или IDE.

Meta представила Muse — агента, который работает после закрытия приложения
23 сентября 2026 г.
Meta представила Muse — агента, который работает после закрытия приложения

Meta запускает Muse — персонального ИИ-агента для поручений в браузере, почте и покупках. Главный вопрос не в обещанной автономности, а в том, как пользователь ограничит доступ к своим данным и деньгам.

OpenAI создала совет математиков после спора о доказательствах ИИ
22 сентября 2026 г.
OpenAI создала совет математиков после спора о доказательствах ИИ

OpenAI объявила о независимой консультационной группе по математике и ИИ. Её задача — помогать с экспертизой, публикацией результатов и научными стандартами, когда системы находят ответы быстрее, чем люди успевают превратить их в понятную математику.

Anthropic выпустила Claude Opus 5.5 и снизила цену на работу с ним
22 сентября 2026 г.
Anthropic выпустила Claude Opus 5.5 и снизила цену на работу с ним

Anthropic представила Claude Opus 5.5 — первую модель семейства 5.5. Компания снизила API-цены, ускорила генерацию и увеличила пятитичасовые лимиты подписок, но сохранила строгие ограничения для чувствительных задач.

OpenAI урезала цены и выпустила GPT-6 Sol и Luna
22 сентября 2026 г.
OpenAI урезала цены и выпустила GPT-6 Sol и Luna

OpenAI представила GPT-6 Sol и GPT-6 Luna — более дешёвые модели семейства GPT-6 для повседневной агентной, программной и офисной работы. Sol и Luna не претендуют на место Astra: ставка релиза — сохранить заметную часть её возможностей при меньшей цене и с более выгодным кэшированием контекста.