Назад
26 августа 2026 г. в 15:10 ИИ Qwen Alibaba открытые модели LLM Qwen / Alibaba, GitHub и Hugging Face

Alibaba открыла Qwen3.8-Flash-Next — предвестник архитектуры Qwen4

Alibaba открыла Qwen3.8-Flash-Next — предвестник архитектуры Qwen4

Alibaba 26 августа открыла веса Qwen3.8-Flash-Next — новой мультимодальной модели семейства Qwen. Это не очередная уменьшенная версия: сама команда называет её ранним образцом архитектуры, которая ляжет в основу Qwen4. Модель уже доступна на Hugging Face и ModelScope, а облачная Qwen3.8-Flash построена на той же базе.

Большая модель с маленьким активным ядром

У Qwen3.8-Flash-Next 125 млрд основных параметров, 51 млрд параметров n-граммных встраиваний и ещё 4 млрд в модуле предсказания токенов. При обработке каждого токена активируются 6 млрд параметров. Это схема со смесью экспертов: модель велика по общей ёмкости, но не задействует весь объём в каждом шаге.

В Qwen говорят, что по сравнению с Qwen3.7-Plus новая архитектура снижает затраты на обучение примерно до одной девятой и при этом улучшает задачи программирования и офисной работы. Это собственные результаты Alibaba, поэтому воспринимать их как независимое сравнение пока рано.

Главное техническое изменение — гибрид Gated DeltaNet и Qwen Sparse Attention. Первый компонент сжимает историю, второй выбирает значимые фрагменты контекста небольшими блоками. Компания рассчитывает, что так длинный контекст будет дешевле для агентных задач, где модель многократно читает документы, код и результаты вызова инструментов.

Проверить до прихода Qwen4

Нативное окно контекста составляет 262 тысячи токенов; в инструкции по запуску указано расширение до миллиона. Модель умеет работать с текстом и изображениями, а Qwen приводит команды для Transformers, vLLM и SGLang. Это означает, что её можно испытать локально или развернуть как совместимый с OpenAI API сервис, хотя для серьёзной нагрузки всё равно понадобится подходящая инфраструктура.

В августе Neuro.ee уже писал об открытии Qwen3.8-27B и весов огромной Qwen3.8-2.4T. Flash-Next продолжает ту же линию, но добавляет другой аргумент: Alibaba открывает не только готовую модель, а архитектурный эксперимент до выпуска следующего семейства. Для разработчиков это редкая возможность заранее проверить, дают ли обещанная экономия и работа с длинным контекстом преимущество в реальных агентных сценариях.

Ещё новости

Cloudflare выпустила Clef-omni: модель решений с аудио и видео
10 октября 2026 г.
Cloudflare выпустила Clef-omni: модель решений с аудио и видео

Cloudflare представила открытую модель решений Clef-omni: она принимает текст, изображения, аудио и видео в одном запросе. Для разработчиков это способ строить классификацию и маршрутизацию без отдельной цепочки распознавания речи и кадров.

Falcon ASR: открытая модель для арабской речи и пяти языков
10 октября 2026 г.
Falcon ASR: открытая модель для арабской речи и пяти языков

TII представил Falcon-ASR — открытую модель распознавания речи с акцентом на арабские диалекты. Она также распознаёт английский, французский, испанский и португальский без ручного выбора языка.

ИИ помогает 10 минут — а потом сложнее думать без него
10 октября 2026 г.
ИИ помогает 10 минут — а потом сложнее думать без него

Исследователи проверили, что происходит, когда доступ к ИИ внезапно исчезает во время сложной задачи. В трёх экспериментах участники с помощником быстрее решали первые задания, но затем чаще ошибались и бросали работу без него.

Anthropic запретила «жестокость» к Claude — но границы пока размыты
9 октября 2026 г.
Anthropic запретила «жестокость» к Claude — но границы пока размыты

Anthropic внесла в правила Claude запрет на «длительное и беспричинное» оскорбительное или жестокое поведение по отношению к своим моделям. Компания обещает применять пункт лишь в крайних случаях, но публичного критерия для этой границы пока нет.

GitHub Copilot CLI научился находить локальные модели Ollama
9 октября 2026 г.
GitHub Copilot CLI научился находить локальные модели Ollama

В Copilot CLI появилась команда, которая показывает совместимые модели из уже запущенного Ollama. Но локальная модель сама по себе не делает сессию офлайн и не отменяет телеметрию GitHub.

Google представила Gemini agent: рабочий ИИ с доступом к корпоративным системам
9 октября 2026 г.
Google представила Gemini agent: рабочий ИИ с доступом к корпоративным системам

Google Cloud представила Gemini agent — корпоративного агента, который получает контекст компании, выбирает модели и выполняет задачи через подключённые системы. Главное для команд — это не новый чат, а ещё одна точка, где придётся заранее определить права, бюджеты и проверку результата.

Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио
8 октября 2026 г.
Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио

Google DeepMind представила открытую 740-миллионную EmbeddingGemma 2: модель сопоставляет текст, изображения, кадры видео и аудио в одном векторном пространстве. Для разработчиков это путь к локальному поиску по медиатеке без обязательной отправки файлов в облако.

В Codex CLI появился вход в MCP-серверы из терминала
8 октября 2026 г.
В Codex CLI появился вход в MCP-серверы из терминала

В версии Codex CLI 0.161.0 OpenAI добавила команду для входа в MCP-серверы из активной терминальной сессии. Обновление также меняет стандартную модель в части каталогов и добавляет настройки голосового режима.

Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле
7 октября 2026 г.
Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле

Anthropic представила Claude Haiku 5.5 — малую модель для быстрых и недорогих задач: от классификации и суммаризации до субагентов и работы в браузере. Для запросов до 100 тысяч токенов вход и выход стали в десять раз дешевле, чем у Haiku 4.5.

Google запустил Playground: игры по текстовому запросу
7 октября 2026 г.
Google запустил Playground: игры по текстовому запросу

Google открыл экспериментальную платформу Playground: пользователь описывает игру текстом, тестирует её в браузере и делится ссылкой. На старте сервис доступен совершеннолетним пользователям из США, а возможности создания зависят от подписки Google One.

OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены
7 октября 2026 г.
OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены

OpenAI открыла каталог результатов внутренней модели: 722 рукописи в 372 связанных семействах. Компания подчёркивает, что материалы находятся на разных стадиях проверки, а часть результатов без формализации в Lean может содержать ошибки.

Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой
7 октября 2026 г.
Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой

Georgia Tech получила одобрение на новую онлайн-магистратуру по искусственному интеллекту. Старт намечен на 2027 год: программа обещает шесть направлений и обязательный проект с компанией или организацией, но детали приёма и стоимости пока не раскрыты.