Alibaba выпустила Qwen3.8-Max: ставка не только на код, а на визуальных агентов
Alibaba выпустила Qwen3.8-Max: ставка не только на код, а на визуальных агентов
Alibaba официально выпустила Qwen3.8-Max — новую Max-модель семейства Qwen. Это продолжение июльского preview, о котором Neuro.ee уже писал: тогда главным вопросом было, станет ли большая модель Qwen открытой. Теперь компания говорит, что веса впервые для Max-класса будут опубликованы на Hugging Face и ModelScope на следующей неделе, а сама модель уже доступна через QwenCloud.
По данным Qwen, модель построена на архитектурной базе Qwen 3.5, имеет 2,4 трлн параметров и 95 млрд активных параметров. В конфигурациях для Codex и OpenClaw указан контекст до 1 млн токенов, поддержка текста и изображений, параллельные вызовы инструментов и уровни reasoning_effort: low, medium и xhigh.
Где Qwen делает ставку
Релиз подан как coding and cowork, но самое интересное в нем не попытка объявить себя новым чемпионом программирования. В собственных таблицах Qwen3.8-Max сильна не в каждой coding-строке: на SWE-bench Pro, DeepSWE 1.1, MLS-Bench-Lite и части внутренних тестов впереди остаются Opus, Fable или GPT5.6 Sol. Прямого сравнения с Kimi и GLM для чистого кодинга в блоге нет, поэтому такой вывод лучше не дорисовывать.
Зато мультимодальный и агентный слой выглядит главным смыслом релиза. Qwen описывает работу с финансовыми отчетами и PDF больше 200 страниц, длинными видео до 100 часов, интерфейсами, скриншотами, Blender, CAD и восстановлением приложений по черному ящику. Важная деталь: зрение используется не только на входе, но и как петля самопроверки — модель смотрит на промежуточный результат, замечает перекосы в интерфейсе, неверную ориентацию объектов или несовпадение с заданием и исправляет план.
Почему это продолжает линию Qwen
Это хорошо стыкуется с предыдущей историей Qwen-AgentWorld: Alibaba строит не просто чат-модель, а инфраструктуру для агентов, которые долго действуют, проверяют себя и дорабатывают результат. В новом релизе эта линия переехала в Max-класс: компания показывает 10-дневный автономный coding-run, пятидневное воспроизведение научной статьи, задачи по юриспруденции, дизайну, инженерии и закупкам.
Для читателя вывод простой: Qwen3.8-Max стоит воспринимать не как очередной ответ на Claude Code или Kimi, а как заявку Alibaba на мультимодального рабочего агента. Проверять ее нужно не одним бенчмарком, а реальными задачами: документы, скриншоты, веб-интерфейсы, долгие циклы правок и цена полного агентного прогона.













