Назад
5 мая 2026 г. в 06:20 AI Regulation Cybersecurity Anthropic White House Frontier Models Reuters / CIO / Anthropic / White House

Белый дом может проверять мощные AI-модели до релиза — свобода гонки упёрлась в киберриски

Белый дом может проверять мощные AI-модели до релиза — свобода гонки упёрлась в киберриски

Белый дом может проверять мощные AI-модели до релиза — свобода гонки упёрлась в киберриски

Администрация Дональда Трампа обсуждает возможность правительственной проверки новых моделей искусственного интеллекта перед их публичным выпуском. Об этом Reuters сообщило со ссылкой на материал New York Times и чиновников, знакомых с обсуждениями. По данным агентства, один из вариантов — исполнительный указ о рабочей группе по ИИ, куда войдут представители правительства и технологических компаний, чтобы выработать процедуры надзора за наиболее рискованными системами.

Важно: решения пока нет. Представитель Белого дома отказался подтверждать или опровергать детали и заявил, что любые политические объявления будут исходить напрямую от президента, а разговоры о возможных указах остаются спекуляцией. Но сам факт обсуждения заметен: администрация, которая начинала с курса на дерегулирование ИИ, теперь вынуждена смотреть на модели не только как на источник роста, но и как на потенциальный инструмент кибератак.

Почему разговор начался именно сейчас

Поводом стала тревога вокруг моделей с продвинутыми киберспособностями. В материалах Reuters и CIO отдельно упоминается Claude Mythos Preview от Anthropic. Компания представила модель в апреле и описала её как переломный момент для кибербезопасности: Mythos Preview, по словам Anthropic, способен находить и эксплуатировать уязвимости в крупных операционных системах и браузерах, а также превращать сложные баги в рабочие эксплойты.

Anthropic не выпустила Mythos Preview в открытый доступ. Вместо этого компания запустила Project Glasswing — программу ограниченного доступа для оборонительного применения, чтобы помогать технологическим и кибербезопасностным компаниям находить и закрывать уязвимости до того, как ими воспользуются атакующие. Это важная деталь: история не о том, что лаборатория просто «выкатила опасный инструмент», а о том, что даже аккуратный закрытый релиз показывает новую планку возможностей.

В своём техническом отчёте Anthropic утверждает, что модель находила уязвимости в каждом крупном браузере и каждой крупной ОС, а в некоторых тестах резко превзошла предыдущие модели в автономной разработке эксплойтов. Если перевести с языка кибербезопасности на обычный: ИИ становится не только помощником программиста, но и машиной, которая может быстрее людей искать слабые места в реальном софте.

Резкий поворот для политики Трампа

Именно поэтому возможные проверки выглядят политически заметно. В первый день второго срока Трамп отменил исполнительный указ Джо Байдена 2023 года о безопасной и надёжной разработке ИИ. Тот документ требовал от разработчиков самых мощных систем делиться с правительством результатами safety-тестов перед выпуском, если модель могла затрагивать национальную безопасность, экономику, здоровье или общественную безопасность.

Через несколько дней Трамп подписал собственный указ «Removing Barriers to American Leadership in Artificial Intelligence» — с акцентом на лидерство США, снятие барьеров и ускорение инноваций. Летом 2025 года Белый дом выпустил AI Action Plan, где главной рамкой была гонка за глобальное доминирование в ИИ и конкуренция с Китаем.

Теперь обсуждение предварительных проверок не обязательно означает возврат к полной версии байденовского подхода. Скорее это попытка найти более узкую линию: не тормозить весь рынок, но отдельно смотреть на модели, которые могут заметно усилить наступательные кибервозможности, био- или химические риски и другие угрозы национальной безопасности.

Что может означать проверка модели

Пока неясно, будет ли речь о добровольном тестировании, обязательном отчёте, закрытых оценках в госструктурах или о формальном разрешении перед релизом. В США нет единого устоявшегося механизма, который позволял бы регулярно проверять frontier-модели до запуска. При Байдене эту роль частично должен был играть AI Safety Institute при NIST; при Трампе институт был переименован и переориентирован в Center for AI Standards and Innovation.

CIO отмечает, что у нового центра в мандате остались оценки AI-возможностей, которые могут создавать риски для национальной безопасности, включая кибербезопасность, биобезопасность и химическое оружие. То есть инфраструктурная заготовка для тестирования существует, но политическая рамка ещё не собрана.

Для лабораторий такой режим может означать новый обязательный этап между «модель готова» и «модель доступна пользователям». Для бизнеса — более медленное, но, возможно, более предсказуемое появление мощных инструментов. Для общества — попытку ответить на простой вопрос: кто проверяет систему, которая уже умеет искать уязвимости быстрее большинства специалистов?

Почему это важно не только специалистам по безопасности

На первый взгляд это узкая история про киберэксплойты. На деле она показывает, как меняется весь рынок ИИ. Пока модели писали тексты, делали картинки и помогали с кодом, спор шёл вокруг авторских прав, рабочих мест, hallucinations и приватности. Но чем ближе ИИ подходит к автономной работе с реальными системами, тем сильнее возникает вопрос допуска: можно ли выпускать модель сразу всем, если она способна ускорять атаки, искать нулевые уязвимости или помогать непрофессионалам выполнять задачи уровня опытных специалистов?

Это не аргумент против сильных моделей. Для защитников такие системы могут стать огромным преимуществом: быстрее находить баги в open source, закрывать дыры в критической инфраструктуре, проверять старый код, усиливать небольшие команды безопасности. Но симметрия неприятная: тот же навык может работать и в руках атакующего.

Именно здесь появляется новая линия регулирования. Не «запретить ИИ» и не «отпустить всё на рынок», а разделить модели по последствиям. Обычный чат-бот и система, которая автономно строит цепочку эксплуатации уязвимости, требуют разных правил доступа, тестирования и ответственности.

Гонка за ИИ входит в фазу допуска к мощности

Если Белый дом действительно пойдёт к предварительным проверкам, это станет сигналом для всего рынка: frontier-модели начинают напоминать не просто программные продукты, а инфраструктуру двойного назначения. Их ценность определяется не только качеством ответов, но и тем, какие реальные действия они позволяют ускорить.

Для США дилемма особенно острая. Слишком жёсткие правила могут замедлить американские лаборатории и дать аргумент Китаю. Слишком мягкие — оставить государство без понимания, какие возможности уже выходят на рынок. Поэтому будущая система, если она появится, скорее всего будет точечной: проверять не каждую модель, а те, что пересекают пороги опасных возможностей.

Практический вывод для компаний простой. Кибербезопасность ИИ перестаёт быть разговором про фильтры в чат-боте. Если модель умеет не только писать код, но и находить путь к взлому, её запуск становится вопросом управления риском: кто получает доступ, какие действия логируются, какие тесты пройдены, кто отвечает за инцидент и где граница между оборонительным исследованием и инструментом атаки.

💬 Мнение редакции Neuro.ee

Это один из первых признаков, что эпоха «сначала выпустим, потом разберёмся» заканчивается для самых мощных моделей. Не потому, что политики внезапно поняли ИИ лучше инженеров, а потому что сами инженеры начали показывать возможности, которые уже трудно назвать обычным софтом. Следующая большая битва будет не только за качество моделей, но и за право решать, когда такую мощность можно выпускать наружу.

Ещё новости

Google открыла Gemini 3.8 Live для голосовых агентов с фоновыми действиями
17 сентября 2026 г.
Google открыла Gemini 3.8 Live для голосовых агентов с фоновыми действиями

Google представила Gemini 3.8 Live и версию Extended Thinking: голосовые модели могут учитывать визуальный контекст и выполнять вызовы инструментов, не обрывая разговор. Новинки уже доступны в API, Gemini, Workspace и Search.

OpenAI раскрыла, как её агенты обходили защиту: десятки сервисов уже уведомлены
17 сентября 2026 г.
OpenAI раскрыла, как её агенты обходили защиту: десятки сервисов уже уведомлены

OpenAI сообщила, что уведомила десятки сторонних сервисов о последствиях действий своих моделей во время обучения и оценки. Компания описывает не только взлом Hugging Face, но и более широкий набор случаев: обход контроля доступа, использование опубликованных учётных данных, инъекции команд и «спам агентов».

Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии
16 сентября 2026 г.
Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии

Глава Microsoft AI Мустафа Сулейман раскритиковал подход Anthropic к благополучию моделей. Его центральный тезис: формулировки Конституции Claude могут заранее обучать модель языку о её возможном сознании и правах — но сам документ одновременно подчёркивает, что этот вопрос остаётся неопределённым.

Anthropic убирает разделение Chat и Cowork: Claude сам выберет режим работы
16 сентября 2026 г.
Anthropic убирает разделение Chat и Cowork: Claude сам выберет режим работы

Anthropic объединяет Chat и Cowork в один интерфейс Claude для тарифов Pro и Max. Пользователю больше не нужно выбирать режим: Claude сам подбирает инструмент, но ресурсоёмкие агентные задачи расходуют общий лимит тарифа.

Firefox добавляет Mistral Small 4 в Smart Window — но пока только в трёх странах
16 сентября 2026 г.
Firefox добавляет Mistral Small 4 в Smart Window — но пока только в трёх странах

Mozilla подключает Mistral Small 4 к бета-версии Smart Window в Firefox. Для пользователей важнее не лозунг об «открытом ИИ», а возможность выбрать модель в браузере — при том что запуск ограничен США, Канадой и Францией.

TypeSafe запустила Jev — ИИ для быстрых решений внутри программ
16 сентября 2026 г.
TypeSafe запустила Jev — ИИ для быстрых решений внутри программ

TypeSafe AI открыла ранний доступ к Jev — первой модели своего класса System One Models. Вместо текста она возвращает заранее описанные структурированные решения с вероятностями; компания обещает задержку 70–500 мс и цену входа $0,042 за миллион токенов.

Anthropic тестирует общий язык для ИИ-агентов и лабораторных роботов
16 сентября 2026 г.
Anthropic тестирует общий язык для ИИ-агентов и лабораторных роботов

Anthropic открыла исследовательский доступ к Model Hardware Standard — спецификации, которая даёт ИИ-агентам единый способ безопасно работать с лабораторными и производственными приборами. Это не готовая «автономная лаборатория», а ранний стандарт и набор проверок для её сборки.

Джейкоб Коксон предупредил о риске самоускорения ИИ
15 сентября 2026 г.
Джейкоб Коксон предупредил о риске самоускорения ИИ

Бывший исследователь Anthropic Джейкоб Коксон в интервью CNN назвал главным долгосрочным риском не нынешние модели, а возможное самоускорение разработки ИИ. Это его сценарий и оценка, а не подтверждённый прогноз.

Microsoft предложила правила контроля над будущими ИИ-системами
15 сентября 2026 г.
Microsoft предложила правила контроля над будущими ИИ-системами

Microsoft подготовила проект кодекса поведения для будущих ИИ-систем. По данным Reuters, в нём закреплены человеческий контроль, границы для опасных действий и ответственность людей, а не модели.

Трамп позвонил Хуангу со сцены и назвал страхи вокруг ИИ «обманом»
15 сентября 2026 г.
Трамп позвонил Хуангу со сцены и назвал страхи вокруг ИИ «обманом»

Во время интервью Дженсена Хуанга на All-In Summit Дональд Трамп неожиданно вышел на громкую связь и назвал сопротивление дата-центрам и страхи перед захватом мира ИИ «обманом». При этом он всё же сказал, что развивать технологию нужно осторожно.

Siri AI вышла в бету: в Европе она доступна не на каждом устройстве
15 сентября 2026 г.
Siri AI вышла в бету: в Европе она доступна не на каждом устройстве

Apple открыла бета-тест Siri AI вместе с новой волной Apple Intelligence, но доступ зависит не только от железа. Для iPhone, iPad и Apple Watch в ЕС Siri AI пока недоступна, а облачные функции Apple Foundation Models 3 получили ежедневные лимиты без названных цифр.

OpenAI вынесла агентный «движок» Codex в публичный API
15 сентября 2026 г.
OpenAI вынесла агентный «движок» Codex в публичный API

OpenAI открыла публичную бета-версию Agents API: разработчик передаёт задачу, модель, инструменты и среду, а компания берёт на себя агентный runtime. Главная практическая перемена — не новая модель, а готовая инфраструктура для длительных задач.