Назад
26 августа 2026 г. в 09:10 AI IBM Granite агенты открытые модели речь IBM Research

IBM выпустила Granite 4.2: открытые модели научили планировать работу агентов

IBM выпустила Granite 4.2: открытые модели научили планировать работу агентов

IBM представила Granite 4.2 — новое семейство открытых языковых моделей для корпоративных агентов. В линейку вошли варианты на 3, 8 и 30 млрд параметров. Главное заявленное изменение — встроенное пошаговое рассуждение: перед действием модель должна уметь разложить задачу, выбрать инструменты и проверить результат.

Для компаний это важнее обычного чат-ответа. Агенту, которому поручили работу с кодом, поиском или внутренними системами, нужно не просто написать текст: он должен понять инструкцию, найти нужные данные, вызвать приложение в правильном порядке и не потерять контроль на промежуточном шаге. IBM говорит, что Granite 4.2 обучали именно на таких сценариях — от работы в терминале до многошаговой разработки.

Открытая модель для рабочих процессов

Модели вышли по лицензии Apache 2.0. Это означает, что их можно скачать, дообучить под свои данные и развернуть в облаке, собственной инфраструктуре или на периферийных устройствах без лицензионных ограничений со стороны IBM. Небольшие версии компания предлагает для потоковых агентских задач, крупную — для более сложного рассуждения и программирования.

IBM также называет сильным местом Granite 4.2 вызов инструментов: модель должна решать, какое приложение использовать и в какой последовательности, а не слепо запускать первый доступный шаг. Это полезно там, где ошибка агента стоит не неудачного ответа, а неверно изменённой записи, сбоя в коде или лишнего доступа к корпоративной системе.

Отдельный выпуск для речи

Вместе с языковыми моделями IBM представила Granite Speech 5.0 Turbo CTC и вариант с ограничениями на коммерческое использование. Это компактные модели распознавания речи без языкового «ядра»; по данным IBM, каждая содержит 470 млн параметров и рассчитана на быструю потоковую расшифровку.

Компания видит для них сценарии от субтитров во время видеозвонка до обработки записей колл-центров. Заявления о скорости пока исходят от самого разработчика, поэтому реальные команды будут проверять качество на своих языках, шумных записях и отраслевой лексике.

Granite 4.2 не обещает, что агент станет самостоятельным сотрудником. Но релиз показывает, куда смещается конкуренция открытых моделей: от хорошего ответа в чате — к управляемой работе с инструментами, кодом и речью внутри компаний.

Ещё новости

Cloudflare выпустила Clef-omni: модель решений с аудио и видео
10 октября 2026 г.
Cloudflare выпустила Clef-omni: модель решений с аудио и видео

Cloudflare представила открытую модель решений Clef-omni: она принимает текст, изображения, аудио и видео в одном запросе. Для разработчиков это способ строить классификацию и маршрутизацию без отдельной цепочки распознавания речи и кадров.

Falcon ASR: открытая модель для арабской речи и пяти языков
10 октября 2026 г.
Falcon ASR: открытая модель для арабской речи и пяти языков

TII представил Falcon-ASR — открытую модель распознавания речи с акцентом на арабские диалекты. Она также распознаёт английский, французский, испанский и португальский без ручного выбора языка.

ИИ помогает 10 минут — а потом сложнее думать без него
10 октября 2026 г.
ИИ помогает 10 минут — а потом сложнее думать без него

Исследователи проверили, что происходит, когда доступ к ИИ внезапно исчезает во время сложной задачи. В трёх экспериментах участники с помощником быстрее решали первые задания, но затем чаще ошибались и бросали работу без него.

Anthropic запретила «жестокость» к Claude — но границы пока размыты
9 октября 2026 г.
Anthropic запретила «жестокость» к Claude — но границы пока размыты

Anthropic внесла в правила Claude запрет на «длительное и беспричинное» оскорбительное или жестокое поведение по отношению к своим моделям. Компания обещает применять пункт лишь в крайних случаях, но публичного критерия для этой границы пока нет.

GitHub Copilot CLI научился находить локальные модели Ollama
9 октября 2026 г.
GitHub Copilot CLI научился находить локальные модели Ollama

В Copilot CLI появилась команда, которая показывает совместимые модели из уже запущенного Ollama. Но локальная модель сама по себе не делает сессию офлайн и не отменяет телеметрию GitHub.

Google представила Gemini agent: рабочий ИИ с доступом к корпоративным системам
9 октября 2026 г.
Google представила Gemini agent: рабочий ИИ с доступом к корпоративным системам

Google Cloud представила Gemini agent — корпоративного агента, который получает контекст компании, выбирает модели и выполняет задачи через подключённые системы. Главное для команд — это не новый чат, а ещё одна точка, где придётся заранее определить права, бюджеты и проверку результата.

Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио
8 октября 2026 г.
Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио

Google DeepMind представила открытую 740-миллионную EmbeddingGemma 2: модель сопоставляет текст, изображения, кадры видео и аудио в одном векторном пространстве. Для разработчиков это путь к локальному поиску по медиатеке без обязательной отправки файлов в облако.

В Codex CLI появился вход в MCP-серверы из терминала
8 октября 2026 г.
В Codex CLI появился вход в MCP-серверы из терминала

В версии Codex CLI 0.161.0 OpenAI добавила команду для входа в MCP-серверы из активной терминальной сессии. Обновление также меняет стандартную модель в части каталогов и добавляет настройки голосового режима.

Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле
7 октября 2026 г.
Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле

Anthropic представила Claude Haiku 5.5 — малую модель для быстрых и недорогих задач: от классификации и суммаризации до субагентов и работы в браузере. Для запросов до 100 тысяч токенов вход и выход стали в десять раз дешевле, чем у Haiku 4.5.

Google запустил Playground: игры по текстовому запросу
7 октября 2026 г.
Google запустил Playground: игры по текстовому запросу

Google открыл экспериментальную платформу Playground: пользователь описывает игру текстом, тестирует её в браузере и делится ссылкой. На старте сервис доступен совершеннолетним пользователям из США, а возможности создания зависят от подписки Google One.

OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены
7 октября 2026 г.
OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены

OpenAI открыла каталог результатов внутренней модели: 722 рукописи в 372 связанных семействах. Компания подчёркивает, что материалы находятся на разных стадиях проверки, а часть результатов без формализации в Lean может содержать ошибки.

Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой
7 октября 2026 г.
Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой

Georgia Tech получила одобрение на новую онлайн-магистратуру по искусственному интеллекту. Старт намечен на 2027 год: программа обещает шесть направлений и обязательный проект с компанией или организацией, но детали приёма и стоимости пока не раскрыты.