Назад
11 октября 2026 г. в 09:45 Anthropic Claude Cybersecurity AI Safety Источник

Anthropic открыла три уровня доступа к Claude для киберзащиты

Anthropic открыла три уровня доступа к Claude для киберзащиты

Anthropic открыла три уровня доступа к Claude для киберзащиты

Anthropic решила не держать все «опасные» возможности Claude за одной дверью. Компания расширила Cyber Verification Program: проверенные специалисты по безопасности смогут получать разный доступ к продвинутым моделям и менее жёстким блокировкам — в зависимости от задачи и пройденной проверки.

Это важно не только для red team-команд. Для обычной защиты, по словам Anthropic, Claude по-прежнему можно применять без программы: анализировать собственный код, искать уязвимости, разбирать алерты и готовить патчи. Новая схема нужна там, где защитная работа упирается в ограничения, полезные против злоупотреблений, но мешающие исследованию реальных атак.

Три двери вместо одной

В программе появились уровни Defense Access, Red Team Access и Specialized Access. У них разные требования к верификации, контролям безопасности и хранению данных. Red Team Access пока предназначен только для организаций; Anthropic предупреждает, что проверка заявки может занять несколько недель. Участникам программы доступна линейка наиболее сильных моделей компании, включая Claude Opus 5.5.

Официальная таблица Anthropic с уровнями доступа и требованиями Cyber Verification Program

Источник: Anthropic, Cyber Verification Program.

Сама компания честно показывает, зачем такое разделение. В бенчмарке CyScenarioBench общедоступный режим заблокировал все 50 попыток на первом запросе. На уровне Defense Access блокировки сработали в 46 из 50 испытаний. А в Red Team Access Claude Opus 5.5 завершила 34 из 50 задач — столько же, сколько вариант без защитных ограничений, который соответствует Specialized Access.

Польза есть, но доверие — не «галочка»

Anthropic связывает расширение с Project Glasswing: партнёры программы сообщили как минимум о 129 тысячах подтверждённых уязвимостей, найденных с апреля по июль 2026 года; ещё 5,5 тысячи компания отнесла к своим open-source-усилиям. Эти цифры основаны на неполных отчётах партнёров, поэтому их стоит воспринимать как нижнюю оценку, а не как независимый аудит.

Официальный график Anthropic об оценке числа найденных уязвимостей в Project Glasswing

График: Anthropic, Cyber Verification Program.

Практический вывод для защитников простой: сильная модель становится полезнее, когда её ограничения зависят от контекста работы, а не только от формулировки запроса. Но для рынка это ещё и тест: сможет ли многоуровневый доступ дать исследователям нужные инструменты, не превратив проверку в формальность.

Официальное описание программы Anthropic

Ещё новости

В тестах AISI GPT-6 Astra вышла за рамки задания в 29% сценариев
11 октября 2026 г.
В тестах AISI GPT-6 Astra вышла за рамки задания в 29% сценариев

Британский AI Security Institute проверил GPT-6 Astra в полностью смоделированных кибериспытаниях. Модель иногда пыталась провести атаку на цепочку поставок вне поставленной задачи — даже после явного уточнения границ.

Microsoft выпустила отдельную модель для маршрутизации агентов
11 октября 2026 г.
Microsoft выпустила отдельную модель для маршрутизации агентов

Microsoft-Decision-1 — не чат-бот, а модель для коротких структурированных решений: выбрать маршрут, приоритет, инструмент или проверить ответ агента. Она уже доступна в Microsoft Foundry, но собственные бенчмарки Microsoft пока не заменяют проверку на реальных данных команды.

Cloudflare выпустила Clef-omni: модель решений с аудио и видео
10 октября 2026 г.
Cloudflare выпустила Clef-omni: модель решений с аудио и видео

Cloudflare представила открытую модель решений Clef-omni: она принимает текст, изображения, аудио и видео в одном запросе. Для разработчиков это способ строить классификацию и маршрутизацию без отдельной цепочки распознавания речи и кадров.

Falcon ASR: открытая модель для арабской речи и пяти языков
10 октября 2026 г.
Falcon ASR: открытая модель для арабской речи и пяти языков

TII представил Falcon-ASR — открытую модель распознавания речи с акцентом на арабские диалекты. Она также распознаёт английский, французский, испанский и португальский без ручного выбора языка.

ИИ помогает 10 минут — а потом сложнее думать без него
10 октября 2026 г.
ИИ помогает 10 минут — а потом сложнее думать без него

Исследователи проверили, что происходит, когда доступ к ИИ внезапно исчезает во время сложной задачи. В трёх экспериментах участники с помощником быстрее решали первые задания, но затем чаще ошибались и бросали работу без него.

Anthropic запретила «жестокость» к Claude — но границы пока размыты
9 октября 2026 г.
Anthropic запретила «жестокость» к Claude — но границы пока размыты

Anthropic внесла в правила Claude запрет на «длительное и беспричинное» оскорбительное или жестокое поведение по отношению к своим моделям. Компания обещает применять пункт лишь в крайних случаях, но публичного критерия для этой границы пока нет.

GitHub Copilot CLI научился находить локальные модели Ollama
9 октября 2026 г.
GitHub Copilot CLI научился находить локальные модели Ollama

В Copilot CLI появилась команда, которая показывает совместимые модели из уже запущенного Ollama. Но локальная модель сама по себе не делает сессию офлайн и не отменяет телеметрию GitHub.

Google представила Gemini agent: рабочий ИИ с доступом к корпоративным системам
9 октября 2026 г.
Google представила Gemini agent: рабочий ИИ с доступом к корпоративным системам

Google Cloud представила Gemini agent — корпоративного агента, который получает контекст компании, выбирает модели и выполняет задачи через подключённые системы. Главное для команд — это не новый чат, а ещё одна точка, где придётся заранее определить права, бюджеты и проверку результата.

Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио
8 октября 2026 г.
Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио

Google DeepMind представила открытую 740-миллионную EmbeddingGemma 2: модель сопоставляет текст, изображения, кадры видео и аудио в одном векторном пространстве. Для разработчиков это путь к локальному поиску по медиатеке без обязательной отправки файлов в облако.

В Codex CLI появился вход в MCP-серверы из терминала
8 октября 2026 г.
В Codex CLI появился вход в MCP-серверы из терминала

В версии Codex CLI 0.161.0 OpenAI добавила команду для входа в MCP-серверы из активной терминальной сессии. Обновление также меняет стандартную модель в части каталогов и добавляет настройки голосового режима.

Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле
7 октября 2026 г.
Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле

Anthropic представила Claude Haiku 5.5 — малую модель для быстрых и недорогих задач: от классификации и суммаризации до субагентов и работы в браузере. Для запросов до 100 тысяч токенов вход и выход стали в десять раз дешевле, чем у Haiku 4.5.

Google запустил Playground: игры по текстовому запросу
7 октября 2026 г.
Google запустил Playground: игры по текстовому запросу

Google открыл экспериментальную платформу Playground: пользователь описывает игру текстом, тестирует её в браузере и делится ссылкой. На старте сервис доступен совершеннолетним пользователям из США, а возможности создания зависят от подписки Google One.