Назад
11 октября 2026 г. в 07:23 AI Microsoft AI Agents Microsoft Foundry Источник

Microsoft выпустила отдельную модель для маршрутизации агентов

Microsoft выпустила отдельную модель для маршрутизации агентов

Microsoft представила Microsoft-Decision-1 — специализированную модель для коротких решений в программах и агентных системах. Она не пишет объяснения и не ведёт диалог: на вход получает текст или JSON и выбирает вариант из заранее заданного набора, возвращая также вероятность выбора.

Для разработчика это другой слой стека. Вместо того чтобы отправлять каждый тикет, запрос или шаг агента в большую языковую модель, Decision-1 можно поставить на «ворота»: определить тему обращения, назначить срочность, выбрать инструмент или модель, отсеять неподходящий контент и передать сомнительный случай человеку.

Не ещё один чат-бот

В документации Microsoft Foundry модель заявлена для классификации, маршрутизации, ранжирования, оценки ответов и двоичных решений. Поддерживаются выбор одной категории, числовая шкала и ответ «да/нет». Для задач, где система должна сработать предсказуемо, это полезнее свободного текста: приложение получает фиксированную структуру, а не пытается извлечь решение из абзаца.

Microsoft сообщает, что дообучила Qwen3.5-9B для однопроходного оценивания. Публичная карточка базовой Qwen3.5-9B на Hugging Face подтверждает существование этой основы, но не служит независимой проверкой качества версии Microsoft.

Цифры пока принадлежат Microsoft

Компания заявляет первое место Decision-1 в сравнении по 36 наборам тестов почти на 150 тысячах вопросов, не использованных при обучении. Также Microsoft называет модель в 2,5 раза быстрее H2O-Lightning-4B v1.1 и примерно в 35 раз быстрее GPT-6 Sol по медианной задержке. Независимой воспроизводимой проверки этих сравнений на момент публикации нет, поэтому воспринимать их как универсальный рейтинг нельзя.

Официальный интерактивный график Microsoft сравнивает точность, задержку и калибровку Microsoft-Decision-1 с другими моделями.

График: Microsoft Command Line, данные JevBench v1.6.1; скриншот официального интерактивного виджета.

Это ограничение важно и для практики. Даже собственная документация Microsoft советует перед автоматизацией проверять пороги вероятности на размеченных примерах своей организации. Низкая уверенность должна быть поводом передать запрос человеку или более мощной модели, а не молча принять решение.

Decision-1 уже доступна в Foundry через варианты развёртывания GlobalStandard и DataZoneStandard в доступных регионах. Для команд, которые строят агентов, новость не в том, что появился очередной «умный» ассистент, а в попытке вынести рутинный выбор из дорогого генеративного вызова в отдельный проверяемый компонент.

Ещё новости

Cloudflare выпустила Clef-omni: модель решений с аудио и видео
10 октября 2026 г.
Cloudflare выпустила Clef-omni: модель решений с аудио и видео

Cloudflare представила открытую модель решений Clef-omni: она принимает текст, изображения, аудио и видео в одном запросе. Для разработчиков это способ строить классификацию и маршрутизацию без отдельной цепочки распознавания речи и кадров.

Falcon ASR: открытая модель для арабской речи и пяти языков
10 октября 2026 г.
Falcon ASR: открытая модель для арабской речи и пяти языков

TII представил Falcon-ASR — открытую модель распознавания речи с акцентом на арабские диалекты. Она также распознаёт английский, французский, испанский и португальский без ручного выбора языка.

ИИ помогает 10 минут — а потом сложнее думать без него
10 октября 2026 г.
ИИ помогает 10 минут — а потом сложнее думать без него

Исследователи проверили, что происходит, когда доступ к ИИ внезапно исчезает во время сложной задачи. В трёх экспериментах участники с помощником быстрее решали первые задания, но затем чаще ошибались и бросали работу без него.

Anthropic запретила «жестокость» к Claude — но границы пока размыты
9 октября 2026 г.
Anthropic запретила «жестокость» к Claude — но границы пока размыты

Anthropic внесла в правила Claude запрет на «длительное и беспричинное» оскорбительное или жестокое поведение по отношению к своим моделям. Компания обещает применять пункт лишь в крайних случаях, но публичного критерия для этой границы пока нет.

GitHub Copilot CLI научился находить локальные модели Ollama
9 октября 2026 г.
GitHub Copilot CLI научился находить локальные модели Ollama

В Copilot CLI появилась команда, которая показывает совместимые модели из уже запущенного Ollama. Но локальная модель сама по себе не делает сессию офлайн и не отменяет телеметрию GitHub.

Google представила Gemini agent: рабочий ИИ с доступом к корпоративным системам
9 октября 2026 г.
Google представила Gemini agent: рабочий ИИ с доступом к корпоративным системам

Google Cloud представила Gemini agent — корпоративного агента, который получает контекст компании, выбирает модели и выполняет задачи через подключённые системы. Главное для команд — это не новый чат, а ещё одна точка, где придётся заранее определить права, бюджеты и проверку результата.

Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио
8 октября 2026 г.
Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио

Google DeepMind представила открытую 740-миллионную EmbeddingGemma 2: модель сопоставляет текст, изображения, кадры видео и аудио в одном векторном пространстве. Для разработчиков это путь к локальному поиску по медиатеке без обязательной отправки файлов в облако.

В Codex CLI появился вход в MCP-серверы из терминала
8 октября 2026 г.
В Codex CLI появился вход в MCP-серверы из терминала

В версии Codex CLI 0.161.0 OpenAI добавила команду для входа в MCP-серверы из активной терминальной сессии. Обновление также меняет стандартную модель в части каталогов и добавляет настройки голосового режима.

Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле
7 октября 2026 г.
Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле

Anthropic представила Claude Haiku 5.5 — малую модель для быстрых и недорогих задач: от классификации и суммаризации до субагентов и работы в браузере. Для запросов до 100 тысяч токенов вход и выход стали в десять раз дешевле, чем у Haiku 4.5.

Google запустил Playground: игры по текстовому запросу
7 октября 2026 г.
Google запустил Playground: игры по текстовому запросу

Google открыл экспериментальную платформу Playground: пользователь описывает игру текстом, тестирует её в браузере и делится ссылкой. На старте сервис доступен совершеннолетним пользователям из США, а возможности создания зависят от подписки Google One.

OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены
7 октября 2026 г.
OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены

OpenAI открыла каталог результатов внутренней модели: 722 рукописи в 372 связанных семействах. Компания подчёркивает, что материалы находятся на разных стадиях проверки, а часть результатов без формализации в Lean может содержать ошибки.

Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой
7 октября 2026 г.
Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой

Georgia Tech получила одобрение на новую онлайн-магистратуру по искусственному интеллекту. Старт намечен на 2027 год: программа обещает шесть направлений и обязательный проект с компанией или организацией, но детали приёма и стоимости пока не раскрыты.