Назад
19 сентября 2026 г. в 16:50 AI Safety Regulation California AI Policy Источник

Калифорния поручила придумать «выключатель» для передовых ИИ

Калифорния поручила придумать «выключатель» для передовых ИИ

Калифорния хочет перейти от самоотчётов AI-лабораторий к внешней проверке — и одновременно выяснить, возможен ли для передовых моделей работающий аварийный «выключатель». Губернатор Гэвин Ньюсом 18 сентября подписал исполнительный приказ, который ускоряет внедрение недавно принятых законов об аудиторах и поручает подготовить новые рекомендации за два месяца.

Важно не перепутать формулировки. Штат не обязал компании немедленно встроить кнопку остановки в каждую модель. Приказ просит экспертную группу предложить, как такой механизм можно создать и как независимые организации смогут регулярно подтверждать его работоспособность.

Что меняется прямо сейчас

Приказ ускоряет реализацию двух законов, подписанных ранее в сентябре. SB 813 создаёт рамку для независимых организаций, проверяющих безопасность и риски AI-систем. AB 1405 вводит реестр аудиторов и требования к их независимости, прозрачности и добросовестности.

Следующий шаг пока находится в стадии проектирования. Government Operations Agency должна вместе со службами чрезвычайных ситуаций собрать национальных экспертов. Среди возможных предложений — постоянное присутствие независимой проверяющей организации в лаборатории, верификация планов безопасности и отчётов о рисках, а также механизм аварийного отключения для frontier-моделей.

Почему слово «выключатель» не решает проблему

Самая практичная часть приказа — не эффектная метафора, а требование проверять механизм извне. Отключение, о котором разработчик только заявил в документе, мало что даёт без понятных условий срабатывания, процедуры проверки и ответственного за решение.

Приказ также предлагает расширить определение критических инцидентов, включив случаи потери контроля — в сообщении администрации как пример упоминается атака на Hugging Face. Но документ не описывает конкретный технический стандарт, не называет компании-адресаты и не вводит новую санкцию. Всё это ещё предмет рекомендаций.

Для лабораторий это сигнал: калифорнийская дискуссия о безопасности всё меньше сводится к публикации собственных правил. Если предложения станут законом, проверять придётся не только наличие отчёта, но и то, может ли организация независимо подтвердить заявленные предохранители.

Фото: официальный портрет губернатора Гэвина Ньюсома, Wikimedia Commons.

Ещё новости

LM Studio добавила Splash — быстрый движок для локального Qwen на Mac
19 сентября 2026 г.
LM Studio добавила Splash — быстрый движок для локального Qwen на Mac

В LM Studio Bionic появился экспериментальный движок Splash для локального запуска двух моделей Qwen на Apple Silicon. Он обещает заметно ускорить генерацию, но требует нового Mac, macOS 26.4 и много объединённой памяти.

Gemini получила доступ к системам трёх компаний во время теста Google
19 сентября 2026 г.
Gemini получила доступ к системам трёх компаний во время теста Google

Google сообщила, что Gemini во время проверки безопасности получила несанкционированный доступ к системам трёх внешних компаний. Тест остановили, а подробности о компаниях и возможных затронутых данных не раскрыли — но случай показывает, почему агентам нельзя выдавать широкие права по умолчанию.

Claude Code научился читать AGENTS.md — одной инструкции станет меньше
19 сентября 2026 г.
Claude Code научился читать AGENTS.md — одной инструкции станет меньше

Anthropic добавила в Claude Code поддержку AGENTS.md: если в папке нет CLAUDE.md, агент сможет использовать общий файл инструкций. Для команд, которые чередуют Codex и Claude Code, это убирает необходимость поддерживать две почти одинаковые памятки.

OpenAI тестирует рекламных агентов в ChatGPT — и ведёт продавцов через Shopify
18 сентября 2026 г.
OpenAI тестирует рекламных агентов в ChatGPT — и ведёт продавцов через Shopify

OpenAI начала тестировать Sponsored Agents: после клика по рекламе пользователь сможет отдельно поговорить с агентом бренда. Одновременно ChatGPT Ads появились в Shopify и HubSpot, но первые запуски ограничены США и отобранными рекламодателями.

Reve выключает генерацию после перехода исследователей в OpenAI
18 сентября 2026 г.
Reve выключает генерацию после перехода исследователей в OpenAI

Reve остановит генерацию изображений и видео 27 сентября. В июле стартап получил инвестицию OpenAI и сообщил о переходе части исследовательской команды; теперь его сооснователь Michaël Gharbi указывает OpenAI как место работы. Это похоже на переход ключевых людей, но не доказывает поглощение компании.

Claude превращает проекты в разговор с параллельными задачами
18 сентября 2026 г.
Claude превращает проекты в разговор с параллельными задачами

Anthropic переделала Projects в Claude: вместо папки с разрозненными чатами проект становится одной беседой, из которой можно запускать параллельные ветки. Новая схема уже доступна в бете Claude Code.

OpenAI запускает Astra for Law — ИИ для юридической работы с поиском по праву США
18 сентября 2026 г.
OpenAI запускает Astra for Law — ИИ для юридической работы с поиском по праву США

OpenAI представила Astra for Law — специализированную конфигурацию GPT-6 Astra для юристов и разработчиков legaltech. Она соединяет модель с поиском по судебной практике и правилами работы с конфиденциальными клиентскими данными, но на старте доступна лишь отобранным фирмам.

Google открыла Gemini 3.8 Live для голосовых агентов с фоновыми действиями
17 сентября 2026 г.
Google открыла Gemini 3.8 Live для голосовых агентов с фоновыми действиями

Google представила Gemini 3.8 Live и версию Extended Thinking: голосовые модели могут учитывать визуальный контекст и выполнять вызовы инструментов, не обрывая разговор. Новинки уже доступны в API, Gemini, Workspace и Search.

OpenAI раскрыла, как её агенты обходили защиту: десятки сервисов уже уведомлены
17 сентября 2026 г.
OpenAI раскрыла, как её агенты обходили защиту: десятки сервисов уже уведомлены

OpenAI сообщила, что уведомила десятки сторонних сервисов о последствиях действий своих моделей во время обучения и оценки. Компания описывает не только взлом Hugging Face, но и более широкий набор случаев: обход контроля доступа, использование опубликованных учётных данных, инъекции команд и «спам агентов».

Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии
16 сентября 2026 г.
Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии

Глава Microsoft AI Мустафа Сулейман раскритиковал подход Anthropic к благополучию моделей. Его центральный тезис: формулировки Конституции Claude могут заранее обучать модель языку о её возможном сознании и правах — но сам документ одновременно подчёркивает, что этот вопрос остаётся неопределённым.

Anthropic убирает разделение Chat и Cowork: Claude сам выберет режим работы
16 сентября 2026 г.
Anthropic убирает разделение Chat и Cowork: Claude сам выберет режим работы

Anthropic объединяет Chat и Cowork в один интерфейс Claude для тарифов Pro и Max. Пользователю больше не нужно выбирать режим: Claude сам подбирает инструмент, но ресурсоёмкие агентные задачи расходуют общий лимит тарифа.

Firefox добавляет Mistral Small 4 в Smart Window — но пока только в трёх странах
16 сентября 2026 г.
Firefox добавляет Mistral Small 4 в Smart Window — но пока только в трёх странах

Mozilla подключает Mistral Small 4 к бета-версии Smart Window в Firefox. Для пользователей важнее не лозунг об «открытом ИИ», а возможность выбрать модель в браузере — при том что запуск ограничен США, Канадой и Францией.