Назад
19 мая 2026 г. в 18:00 AI Google Gemini Agents Models Google DeepMind

Google выпустила Gemini 3.5 Flash для быстрых AI-агентов

Google выпустила Gemini 3.5 Flash для быстрых AI-агентов

Google выпустила Gemini 3.5 Flash — новую модель семейства Gemini, которую компания описывает как вариант для «почти Pro-интеллекта» на скорости и цене класса Flash. Это не просто очередное встраивание Gemini в поиск: главный факт в том, что у Google появилась отдельная общедоступная модель для агентного кода, параллельных агентов и длинных рабочих сценариев.

В документации Google Cloud модель уже указана с ID gemini-3.5-flash, общедоступной стадией и датой релиза 19 мая 2026 года. Она принимает текст, код, изображения, аудио, видео и PDF, а на выходе даёт текст. Лимиты крупные: до 1 048 576 входных токенов и до 65 535 выходных токенов. Дата отсечения знаний — январь 2025 года.

Что именно выпустила Google

Gemini 3.5 Flash занимает промежуточную позицию между дорогими моделями для рассуждений и массовыми Flash-вариантами. На странице DeepMind она стоит рядом с Gemini 3.1 Pro и Gemini 3.1 Flash-Lite, но роль сформулирована иначе: передовая производительность для агентов и кода. В Google Cloud формулировка ещё конкретнее: уровень Pro в программировании, параллельное выполнение агентных задач и цена со скоростью класса Flash.

Для разработчиков важны не только слова про «агентность», а набор поддерживаемых режимов. В модели заявлены привязка к Google Search, выполнение кода, системные инструкции, вызов функций, подсчёт токенов, структурированный вывод, режим рассуждения, явное и неявное кэширование контекста, а также совместимость с Chat Completions. При этом Gemini Live API и Content Credentials для этой модели не поддерживаются.

Контекст, цены и бенчмарки

На стандартном глобальном тарифе Google Cloud Gemini 3.5 Flash стоит $1,50 за 1 млн входных токенов и $9 за 1 млн выходных токенов. Кэшированный ввод стоит $0,15 за 1 млн токенов. Для Flex/Batch цены ниже: $0,75 за вход и $4,50 за выход на глобальной точке доступа. Для неглобальных регионов Google указывает наценку, которая должна вступить в силу 1 июля 2026 года.

По бенчмаркам Google рисует модель как рабочую лошадку для агентных задач. На Terminal-bench 2.1 она набирает 76,2% против 58,0% у Gemini 3 Flash и 78,2% у GPT-5.5. На SWE-Bench Pro — 55,1%, на MCP Atlas для многошаговых процессов через MCP — 83,6%, на OSWorld-Verified для компьютерного управления — 78,4%. В мультимодальных тестах заявлены 83,6% на MMMU-Pro и 84,2% на CharXiv, а в длинном контексте MRCR v2 для 1 млн токенов — 26,6%.

Отдельный акцент — скорость в реальных демонстрациях. DeepMind показывает сценарии, где Gemini 3.5 Flash генерирует несколько вариантов платёжного интерфейса меньше чем за минуту, строит интерактивные HTML-компоненты, координирует несколько агентов и разбирает длинные документы. Это не доказывает надёжность в продакшене, но хорошо объясняет позиционирование: модель должна быть достаточно сильной для агента, но достаточно быстрой для частого использования.

Где она появится

Google связывает Gemini 3.5 Flash с Agent Platform, Google AI Studio, Gemini API и корпоративными агентными сценариями. На стороне обычных пользователей похожая логика уже видна в Search AI Mode и приложении Gemini: модель не только отвечает текстом, но может строить визуальные ответы, таблицы, симуляции и небольшие интерактивные инструменты под запрос.

Для рынка это важнее сухого списка процентов. Google пытается занять слой, где сейчас конкурируют OpenAI Codex, Claude, Cursor, Windsurf, Replit и корпоративные агентные платформы: не «кто умнее в чате», а «кто дешевле и стабильнее закрывает длинную задачу с файлами, инструментами, браузером и проверкой результата».

Главный вопрос к Gemini 3.5 Flash теперь практический: выдержит ли модель обещанный баланс цены, скорости и агентной надёжности вне демонстраций. Но угол новости уже ясен. Google выпустила не просто функцию для поиска, а новую модель для массового агентного слоя — с понятным ID, лимитами, ценой, бенчмарками и местом в своей платформе.

Ещё новости

Meta открыла SDK для устройств Muse: агент можно подключить к ESP32 и Raspberry Pi
3 октября 2026 г.
Meta открыла SDK для устройств Muse: агент можно подключить к ESP32 и Raspberry Pi

Meta опубликовала открытые SDK и прошивки для самодельных устройств, подключаемых к персональному агенту Muse. Практический смысл — вывести агента из приложения на кнопки, дисплеи, датчики и домашние сценарии, но для сопряжения всё равно нужен токен и режим разработчика.

ИИ помог прочитать шифр Наполеоновской войны, молчавший 217 лет
2 октября 2026 г.
ИИ помог прочитать шифр Наполеоновской войны, молчавший 217 лет

ИИ-инженер Картер Чёрч с помощью GPT-6 Astra расшифровал письмо для генерала Огюста де Мармона, известное лишь по скану 1969 года. Важен не только результат, но и рабочий процесс: модель одновременно читала рукописные знаки, строила ключ гомофонического шифра и проверяла гипотезы по исходному изображению.

Microsoft выпустила расшифровку, которая начинает работать до конца фразы
2 октября 2026 г.
Microsoft выпустила расшифровку, которая начинает работать до конца фразы

Microsoft AI представила потоковую модель MAI-Transcribe-2-Streaming и две голосовые модели. Главная ставка — голосовые агенты, которые могут начать обработку запроса ещё во время речи.

Калифорния запретила увольнять людей по решению одного ИИ
2 октября 2026 г.
Калифорния запретила увольнять людей по решению одного ИИ

Губернатор Калифорнии Гэвин Ньюсом подписал пакет законов о применении ИИ на работе. Работодатель больше не может опираться только на автоматизированную систему при дисциплинарном взыскании или увольнении.

Google вывел на орбиту спутник для проверки ИИ-инфраструктуры в космосе
2 октября 2026 г.
Google вывел на орбиту спутник для проверки ИИ-инфраструктуры в космосе

Google подтвердил работу первого спутника Project Suncatcher. Эксперимент должен показать, выдержат ли TPU физические условия космоса — это ранняя проверка идеи орбитальной инфраструктуры для машинного обучения.

OpenClaw представил Enterprise для пилотов корпоративных ИИ-агентов
1 октября 2026 г.
OpenClaw представил Enterprise для пилотов корпоративных ИИ-агентов

OpenClaw открыл разработку Enterprise — платформы управления постоянными ИИ-агентами в корпоративной инфраструктуре. Проект пока предназначен для внутренних пилотов, но уже заявляет изоляцию задач, аудит и гибкую замену компонентов агента.

HydraFusion появился в VS Code и приложении GitHub Copilot
1 октября 2026 г.
HydraFusion появился в VS Code и приложении GitHub Copilot

GitHub расширил исследовательский предварительный доступ к HydraFusion: режим выбора нескольких моделей теперь доступен не только в Copilot CLI. Для команд это означает больше контроля над сложными задачами, но пока с условиями предварительного доступа.

IBM Bob разрешили запускать внутри закрытой инфраструктуры
1 октября 2026 г.
IBM Bob разрешили запускать внутри закрытой инфраструктуры

IBM добавила для своего агентного инструмента разработки Bob self-hosted-развёртывание. Компания позиционирует его для команд, которым нельзя отправлять код и контекст приложений во внешний облачный сервис.

Google показала Gemini 4 Argon, но пока не отдаёт её разработчикам
1 октября 2026 г.
Google показала Gemini 4 Argon, но пока не отдаёт её разработчикам

Google представила Gemini 4 Argon — новую флагманскую модель для программирования, корпоративных задач и киберзащиты. Но первый доступ получили только доверенные защитники в программе Fairwind: публичный API и приложение Gemini пока не открыты.

Airbnb добавляет ИИ-поиск: голосом, своими словами и с сравнением жилья
30 сентября 2026 г.
Airbnb добавляет ИИ-поиск: голосом, своими словами и с сравнением жилья

Airbnb запустила в США ИИ-инструменты для планирования поездки: поиск и фильтры обычным языком, краткие описания объявлений и сравнение сохранённых вариантов. Для европейских пользователей важная оговорка: в анонсе эти функции не обещаны, зато доставка еды и продуктов расширяется в Европе лишь в отдельных городах.

OpenAI Dots: агент в ChatGPT, которому дают работать между сообщениями
30 сентября 2026 г.
OpenAI Dots: агент в ChatGPT, которому дают работать между сообщениями

OpenAI представила Dots — платный агентный продукт внутри ChatGPT. Его идея не в одиночном ответе, а в непрерывной рабочей переписке, где задача может продолжаться в фоне.

OpenAI превращает ChatGPT в рабочую платформу для людей и агентов
29 сентября 2026 г.
OpenAI превращает ChatGPT в рабочую платформу для людей и агентов

На DevDay 2026 OpenAI описала ChatGPT как общую рабочую поверхность для людей, агентов и нативных приложений разработчиков. В самом recap нет условий доступа к отдельным продуктам, поэтому их нельзя считать доступными всем пользователям.