Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле
Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле
Anthropic представила Claude Haiku 5.5 — новую малую модель для задач, где важны задержка и цена: суммаризации, классификации, поддержки в реальном времени, субагентов в системах с несколькими моделями и управления браузером. Компания называет её самым быстрым Claude при стандартной скорости; режим Fast у Opus в это сравнение не входит.
Релиз доступен через Claude Platform под идентификатором claude-haiku-5-5, а также в Amazon Web Services, Google Cloud и Microsoft Azure. Важная новинка для линейки Haiku — настраиваемый уровень усилий: разработчик может выбрать, экономить ли на вычислениях или получить более сильный ответ.
Цена резко упала, но есть граница в 100 тысяч токенов
Для промптов до 100 тысяч токенов миллион входных токенов стоит $0,10, выходных — $0,50. Для более длинных запросов тарифы составляют $0,50 и $2,50 соответственно. У Haiku 4.5 это было $1 и $5 вне зависимости от длины контекста.
Anthropic оценивает снижение цены относительно предшественника в 90% для коротких запросов и в 50% для длинных; в среднем — примерно в 75%. В сноске компания уточняет: новый токенизатор может расходовать немного больше токенов на одну и ту же работу, поэтому сравнивать стоит стоимость завершённой задачи, а не только прайс-лист.
Заявленные тесты — сильнее, но не независимый рейтинг
В официальном анонсе Anthropic Haiku 5.5 получила 72,4% на офлайн-подмножестве OSWorld 2.1 — тесте управления компьютером; у Haiku 4.5 указано 15,7%. На Terminal-Bench 4.0 для агентного программирования результаты составили 39,2% и 0% соответственно.

График: Anthropic, Claude Haiku 5.5 System Card.
Это опубликованные разработчиком результаты, а не независимая сводка. Они всё же объясняют замысел релиза: недорогую модель пытаются вывести из роли «простого классификатора» в роль рабочего исполнителя внутри более крупного агента.
Для продуктов с большим числом коротких обращений разница в цене может быть существеннее очередного рекорда на одном тесте. Но для длинного контекста скидка заметно меньше, а сложные задачи по-прежнему требуют проверки — особенно если Haiku работает с браузером или внешними инструментами.













