Назад
24 августа 2026 г. в 15:05 AI Alibaba Wan3.0 видео модели генеративный ИИ Reuters

Alibaba выпустила Wan3.0: видео по запросу теперь можно генерировать длиной до 30 секунд

Alibaba выпустила Wan3.0: видео по запросу теперь можно генерировать длиной до 30 секунд

Alibaba выпустила Wan3.0 — новую модель для генерации видео. Reuters сообщил о запуске 24 августа; по данным The Next Web, система рассчитана на клипы продолжительностью до 30 секунд. Для рынка это заметный сдвиг: многие генераторы всё ещё удобнее всего работают с очень короткими фрагментами, которые затем приходится склеивать вручную.

Зачем нужна длина в 30 секунд

Полминуты — всё ещё не готовый фильм, но уже рабочая длина для рекламной сцены, объясняющего ролика, анимированной заставки или черновой раскадровки. В таких задачах важны не только отдельные красивые кадры, но и сохранение действия, композиции и логики сцены на протяжении ролика. Именно здесь у генеративного видео обычно возникают самые заметные ошибки.

Reuters связывает выпуск Wan3.0 с более широкой ставкой Alibaba на искусственный интеллект. В день запуска компания также оказалась в новостях из-за привлечения около 10 млрд долларов через размещение акций, но для пользователей и разработчиков практическое значение — в самом новом инструменте, а не в сделке.

Конкуренция идёт за рабочий ролик

Генерация видео быстро становится отдельным полем борьбы крупных лабораторий. Условный «красивый пятисекундный кадр» уже мало кому интересен сам по себе: студиям, маркетингу и разработчикам нужны ролики, которые можно встроить в производство без долгой ручной сборки.

О возможностях Wan3.0 пока стоит говорить осторожно. Сообщения о релизе подтверждают запуск и заявленную длину клипа, но не дают независимого сравнения качества с конкурентами. На практике компании будут проверять, насколько модель удерживает персонажей, текст, движение камеры и заданный сценарий — и сколько стоит серия попыток до приемлемого результата.

Для рынка важен уже сам темп: крупная китайская платформа выводит новую видеомодель в тот момент, когда генеративное видео переходит от демонстраций к задачам с понятным хронометражем и производственным бюджетом. Пользователям же придётся отдельно оценить доступность сервиса, языковые ограничения и условия коммерческого использования.

Ещё новости

Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио
8 октября 2026 г.
Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио

Google DeepMind представила открытую 740-миллионную EmbeddingGemma 2: модель сопоставляет текст, изображения, кадры видео и аудио в одном векторном пространстве. Для разработчиков это путь к локальному поиску по медиатеке без обязательной отправки файлов в облако.

В Codex CLI появился вход в MCP-серверы из терминала
8 октября 2026 г.
В Codex CLI появился вход в MCP-серверы из терминала

В версии Codex CLI 0.161.0 OpenAI добавила команду для входа в MCP-серверы из активной терминальной сессии. Обновление также меняет стандартную модель в части каталогов и добавляет настройки голосового режима.

Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле
7 октября 2026 г.
Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле

Anthropic представила Claude Haiku 5.5 — малую модель для быстрых и недорогих задач: от классификации и суммаризации до субагентов и работы в браузере. Для запросов до 100 тысяч токенов вход и выход стали в десять раз дешевле, чем у Haiku 4.5.

Google запустил Playground: игры по текстовому запросу
7 октября 2026 г.
Google запустил Playground: игры по текстовому запросу

Google открыл экспериментальную платформу Playground: пользователь описывает игру текстом, тестирует её в браузере и делится ссылкой. На старте сервис доступен совершеннолетним пользователям из США, а возможности создания зависят от подписки Google One.

OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены
7 октября 2026 г.
OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены

OpenAI открыла каталог результатов внутренней модели: 722 рукописи в 372 связанных семействах. Компания подчёркивает, что материалы находятся на разных стадиях проверки, а часть результатов без формализации в Lean может содержать ошибки.

Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой
7 октября 2026 г.
Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой

Georgia Tech получила одобрение на новую онлайн-магистратуру по искусственному интеллекту. Старт намечен на 2027 год: программа обещает шесть направлений и обязательный проект с компанией или организацией, но детали приёма и стоимости пока не раскрыты.

Mistral Large 4: API уже доступен, веса — в конце октября
6 октября 2026 г.
Mistral Large 4: API уже доступен, веса — в конце октября

Mistral открыла public preview Mistral Large 4 — мультимодальной модели с 1 трлн параметров, из которых активно 49 млрд. В API её уже можно попробовать, но обещанные open weights появятся лишь в конце октября.

Reflection показала Beam на 501 млрд параметров — но веса выйдут позже
6 октября 2026 г.
Reflection показала Beam на 501 млрд параметров — но веса выйдут позже

Reflection представила Beam — открытую по весам MoE-модель для кода, рассуждений и агентов. Пока это ранний доступ: веса, model card и технический отчёт обещаны лишь позднее в октябре.

OpenAI начнёт маркировать тексты ChatGPT и Codex в ЕС
6 октября 2026 г.
OpenAI начнёт маркировать тексты ChatGPT и Codex в ЕС

OpenAI сообщила, что будет добавлять невидимую маркировку в тексты ChatGPT и Codex для пользователей из ЕС. Метка должна помочь выполнять требования AI Act, но компания признаёт: после существенной правки текста её будет труднее обнаружить.

GitHub открыла API для запуска проверок кода Copilot
5 октября 2026 г.
GitHub открыла API для запуска проверок кода Copilot

GitHub разрешила запускать проверку pull request’ов Copilot через REST и GraphQL API. Одновременно для новых и уже существующих репозиториев стандартным уровнем тщательности стал Balanced.

AWS показала Well-Architected Agent: ИИ-ревизор для облака, но с правами и проверкой человеком
5 октября 2026 г.
AWS показала Well-Architected Agent: ИИ-ревизор для облака, но с правами и проверкой человеком

AWS открыла предварительный доступ к Well-Architected Agent — сервису, который анализирует инфраструктуру и предлагает исправления для стоимости, производительности, устойчивости и безопасности. Рекомендации могут включать изменения IaC, но AWS отдельно предупреждает: генеративный ИИ способен ошибаться.

Google урезает доступ к Gemini: бесплатным оставят Flash-Lite
4 октября 2026 г.
Google урезает доступ к Gemini: бесплатным оставят Flash-Lite

Google меняет набор моделей Gemini для бесплатных пользователей и подписки AI Plus. С 9 октября доступ к Pro исчезнет у обоих уровней, а платный AI Pro получит Deep Think.