Назад
29 сентября 2026 г. в 06:30 AI Anthropic Claude LLM Agents Coding Источник

Anthropic выпустила Claude Sonnet 5.5 с киберзащитой уровня Opus

Anthropic выпустила Claude Sonnet 5.5 с киберзащитой уровня Opus

Anthropic выпустила Claude Sonnet 5.5 с киберзащитой уровня Opus

Anthropic представила Claude Sonnet 5.5 — вторую модель семейства 5.5. Компания нацеливает её на чётко поставленные ежедневные задачи: исправление кода, документы, презентации, таблицы и быстрые агентные циклы. Для неоднозначной работы, где нужно долго взвешивать решения, Anthropic по-прежнему рекомендует Opus 5.5.

Релиз уже доступен в приложениях Claude, Claude Code и API, а также через Amazon Web Services, Google Cloud и Microsoft Azure. Идентификатор модели в Claude Platform — claude-sonnet-5-5.

Скачок на агентных тестах

Главная цифра из официального анонса Anthropic: на Terminal-Bench 4.0 Sonnet 5.5 набрала 70,6%, тогда как Sonnet 5 — 10,3%. В таблице компании новая модель также почти догоняет Opus 5.5 на OSWorld и распознавании графиков. Это результаты производителя, а не независимый рейтинг, поэтому они показывают прежде всего заявленную позицию модели.

Официальная таблица Anthropic с результатами Claude Sonnet 5.5, Sonnet 5, Opus 5.5 и GPT-6 Sol на кодовых и рабочих тестах

График: Anthropic.

Два следующих графика важнее одного максимального балла: они сопоставляют точность и стоимость одной попытки на разных уровнях усилий. Anthropic утверждает, что в ряде тестов Sonnet 5.5 на низком или среднем уровне усилий обходит лучший результат Sonnet 5 примерно за десятую часть цены одной попытки. При высоком уровне усилий экономическое преимущество сокращается.

Графики Anthropic «точность против стоимости» для Terminal-Bench, FrontierCode, CursorBench и AA-Briefcase

График: Anthropic.

Та же цена за токен, другие ограничения

Тариф остался на уровне Sonnet 5: $2 за миллион входных токенов, $10 за миллион выходных и $0,20 за чтение из кэша. Anthropic заявляет, что модель обычно расходует меньше токенов на ту же работу, поэтому задача может обходиться до 30% дешевле; генерация, по её тестам, стала быстрее более чем на 30%.

Таблица Anthropic с ценами Claude Sonnet 5.5 и Claude Opus 5.5 за миллион токенов

Источник: Anthropic.

Вместе с ростом кибервозможностей Anthropic добавила защиту уровня Opus: часть высокорисковых запросов будет заметно переключаться на Sonnet 5. Обычная отладка и большинство задач в биологии, по словам компании, не затронуты. Для разработчиков это важная оговорка: Sonnet 5.5 выглядит как новый рабочий вариант для массовых агентов, но не как безусловная замена более сильному Opus в сложных задачах.

Ещё новости

Anthropic идёт к IPO с убытком $42 млрд и планом потратить $518 млрд на ИИ
29 сентября 2026 г.
Anthropic идёт к IPO с убытком $42 млрд и планом потратить $518 млрд на ИИ

Reuters ознакомилось с конфиденциальным проспектом Anthropic перед IPO: при выручке $4,6 млрд за 2025 год компания показала чистый убыток $42 млрд и описала план расходов на вычисления и инфраструктуру в $518 млрд на 2027 год. Большая часть убытка — бухгалтерская переоценка инструментов, связанных с будущими акциями; откуда возьмутся деньги на заявленный план, в материале не раскрывается.

Manus даёт личному ИИ-агенту почту, телефон и кошелёк
29 сентября 2026 г.
Manus даёт личному ИИ-агенту почту, телефон и кошелёк

Manus представила Manus 2.0 и приложение Cue, где персональному агенту обещают собственные email, телефон, кошелёк и компьютер. Для бизнеса это переносит главный вопрос от качества ответов к управлению учётными записями, деньгами и журналом действий.

NVIDIA открыла платформу безопасности для ИИ-агентов
28 сентября 2026 г.
NVIDIA открыла платформу безопасности для ИИ-агентов

NVIDIA представила Open Agent Safety Platform — набор открытых компонентов и эталонную архитектуру для контроля действий ИИ-агентов. Ключевая идея: критические ограничения должны проверяться вне самой модели.

NYT: правительства всё сильнее отстают от развития ИИ
28 сентября 2026 г.
NYT: правительства всё сильнее отстают от развития ИИ

The New York Times пишет, что разрыв между скоростью развития ИИ и скоростью выработки правил стал шире, чем когда-либо. Пока модели и агенты быстро выходят за пределы лабораторий, у мира нет общего механизма, который определял бы допустимый риск и ответственность.

Bloomberg: Китай расширил ограничения на поездки семей AI- и чип-специалистов
28 сентября 2026 г.
Bloomberg: Китай расширил ограничения на поездки семей AI- и чип-специалистов

Bloomberg сообщает, что Китай распространил ограничения на зарубежные поездки ключевых сотрудников частных AI- и полупроводниковых компаний на членов их семей. Публикация не подтверждает появление отдельной системы «выездных виз»: речь идёт о мерах контроля поездок, а не о визе, которую выдаёт другая страна.

Meta добавит в WhatsApp говорящий аватар для звонков с очков
26 сентября 2026 г.
Meta добавит в WhatsApp говорящий аватар для звонков с очков

Meta готовит Hologram — цифровое изображение лица для звонков из очков Meta Ray-Ban Display. Аватар будет реагировать на голос, но первый запуск ограничен ранним доступом в США.

Google добавила говорящие аватары в Gemini Enterprise
26 сентября 2026 г.
Google добавила говорящие аватары в Gemini Enterprise

Google открыла для Gemini Enterprise Live Avatar: корпоративный голосовой агент теперь может отвечать с синхронизированным видеоаватаром. Функция полезна для сервисных сценариев, но создание собственных персонажей пока требует allowlist.

Google Beam выходит в шесть стран: 3D-видеосвязь становится ближе к офисам
26 сентября 2026 г.
Google Beam выходит в шесть стран: 3D-видеосвязь становится ближе к офисам

Google расширяет поставки Beam — системы видеосвязи с эффектом присутствия — на шесть стран и запускает сеть демонстрационных переговорных. Важно не само обещание «как в одной комнате», а то, что устройство начинает появляться там, где его можно испытать до покупки.

Microsoft встраивает Word, Excel и PowerPoint в новый Copilot
26 сентября 2026 г.
Microsoft встраивает Word, Excel и PowerPoint в новый Copilot

Microsoft представила новый интерфейс Copilot: в нём объединяются чат и агентный режим, а документы Word, таблицы Excel и презентации PowerPoint можно создавать и править прямо из разговора. Первые функции доступны не всем: Home и Code начинают раскатывать в программе Frontier, а Autopilot пока идёт в закрытый предварительный доступ.

Gemini подключает Adobe, Airtable и Linear: ИИ добирается до списка дел
23 сентября 2026 г.
Gemini подключает Adobe, Airtable и Linear: ИИ добирается до списка дел

Google расширяет Connected Apps в Gemini: ассистент получает новые связки с Adobe, Airtable, Linear, Peloton и другими сервисами. Главный вопрос теперь не в количестве подключений, а в том, какие действия и данные пользователь готов отдать в один чат.

AWS запустила CloudWatch Omni для отладки ИИ-агентов
23 сентября 2026 г.
AWS запустила CloudWatch Omni для отладки ИИ-агентов

AWS представила CloudWatch Omni — отдельную среду наблюдаемости для приложений и ИИ-агентов. Сервис собирает трассы, метрики и логи в одном интерфейсе и позволяет расследовать сбои через чат или IDE.

Meta представила Muse — агента, который работает после закрытия приложения
23 сентября 2026 г.
Meta представила Muse — агента, который работает после закрытия приложения

Meta запускает Muse — персонального ИИ-агента для поручений в браузере, почте и покупках. Главный вопрос не в обещанной автономности, а в том, как пользователь ограничит доступ к своим данным и деньгам.