Назад
26 мая 2026 г. в 06:10 AI Google Gemini Video AI YouTube Shorts Creative Tools Google / Google DeepMind / YouTube

Google запустила Gemini Omni: видео теперь можно редактировать разговором

Google запустила Gemini Omni: видео теперь можно редактировать разговором

Google представила Gemini Omni Flash — первую модель в новой семье Gemini Omni. Компания описывает ее как систему, где мультимодальное понимание Gemini соединяется с генерацией: пользователь может дать текст, изображение, видео или аудио и получить новый ролик, а затем править его обычными фразами. Запуск начинается с видео, но Google говорит, что позже семья Omni должна поддерживать и другие выходные форматы, включая изображения и аудио.

Сначала Gemini Omni Flash появляется в Gemini app, Google Flow и YouTube Shorts. Для подписчиков Google AI Plus, Pro и Ultra модель раскатывается глобально через Gemini и Flow, а в Shorts Remix и YouTube Create она будет доступна бесплатно с этой недели. В ближайшие недели Google обещает вывести Omni к разработчикам и корпоративным клиентам через API.

Монтаж без таймлайна

Самая понятная часть анонса — разговорное редактирование видео. Google показывает сценарии, где пользователь берет исходный ролик и просит изменить материал: сделать скульптуру из пузырей, поменять действие в сцене, добавить объект, перенести музыканта в другое окружение, изменить угол камеры или синхронизировать свет с музыкой. Важно, что правки могут идти цепочкой: каждая следующая команда опирается на предыдущую, а модель пытается сохранить персонажей, физику и контекст сцены.

Это отличается от привычной генерации ролика «с нуля». Для многих людей полезнее не получить случайный красивый клип, а взять свой материал и быстро довести его до нужного вида: убрать лишнее, сменить стиль, добавить эффект, превратить зарисовку в объясняющий ролик или адаптировать идею под короткое видео. Поэтому Omni особенно важна не как очередной конкурс красивых демо, а как шаг к монтажу через намерение, без обязательного знания профессионального интерфейса.

Почему YouTube здесь важен

Отдельный смысл запуска — YouTube Shorts. YouTube пишет, что Omni позволит ремиксовать подходящие Shorts: пользователь сможет добавить запросы и изображения, изменить сцену, вставить себя рядом с автором или развить чужой ролик в новом направлении, при этом контекст исходного видео должен сохраняться. Для платформы коротких видео это сильный ход: AI-монтаж становится не отдельным приложением, а частью привычного потока просмотра и ремикса.

Для создателей это одновременно возможность и новый источник напряжения. Видео станет проще переделывать, а значит идеи будут быстрее копироваться, стилизоваться и расходиться по платформам. Google обещает водяные знаки SynthID, Content Credentials, ссылки на оригинальный ролик, возможность отключить визуальный ремикс и расширение инструмента обнаружения likeness для авторов старше 18 лет. Эти ограничения не декоративны: чем дешевле становится убедительное видео, тем важнее понимать, откуда оно взялось и кто разрешил его использовать.

Что это меняет

Gemini Omni показывает, куда движется рынок генеративного видео после первых вау-роликов. Главная конкуренция смещается от «модель умеет сделать красивую сцену» к «модель умеет управляемо менять уже существующий материал». Для бизнеса, образования, рекламы, блогеров и обычных пользователей это практичнее: видео можно будет не только генерировать, но и исправлять итерациями, как текст в чате.

При этом Google пока аккуратно ограничивает обещания. Редактирование речи и звука за пределами собственных аватаров компания еще тестирует, API появится позже, а доступ и функции будут зависеть от подписки и региона. Но направление уже видно: AI-видео перестает быть отдельной лабораторной демонстрацией и становится частью массовых продуктов, где вопрос «как это сделать» постепенно заменяется вопросом «что именно я хочу изменить».

Ещё новости

Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио
8 октября 2026 г.
Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио

Google DeepMind представила открытую 740-миллионную EmbeddingGemma 2: модель сопоставляет текст, изображения, кадры видео и аудио в одном векторном пространстве. Для разработчиков это путь к локальному поиску по медиатеке без обязательной отправки файлов в облако.

В Codex CLI появился вход в MCP-серверы из терминала
8 октября 2026 г.
В Codex CLI появился вход в MCP-серверы из терминала

В версии Codex CLI 0.161.0 OpenAI добавила команду для входа в MCP-серверы из активной терминальной сессии. Обновление также меняет стандартную модель в части каталогов и добавляет настройки голосового режима.

Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле
7 октября 2026 г.
Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле

Anthropic представила Claude Haiku 5.5 — малую модель для быстрых и недорогих задач: от классификации и суммаризации до субагентов и работы в браузере. Для запросов до 100 тысяч токенов вход и выход стали в десять раз дешевле, чем у Haiku 4.5.

Google запустил Playground: игры по текстовому запросу
7 октября 2026 г.
Google запустил Playground: игры по текстовому запросу

Google открыл экспериментальную платформу Playground: пользователь описывает игру текстом, тестирует её в браузере и делится ссылкой. На старте сервис доступен совершеннолетним пользователям из США, а возможности создания зависят от подписки Google One.

OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены
7 октября 2026 г.
OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены

OpenAI открыла каталог результатов внутренней модели: 722 рукописи в 372 связанных семействах. Компания подчёркивает, что материалы находятся на разных стадиях проверки, а часть результатов без формализации в Lean может содержать ошибки.

Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой
7 октября 2026 г.
Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой

Georgia Tech получила одобрение на новую онлайн-магистратуру по искусственному интеллекту. Старт намечен на 2027 год: программа обещает шесть направлений и обязательный проект с компанией или организацией, но детали приёма и стоимости пока не раскрыты.

Mistral Large 4: API уже доступен, веса — в конце октября
6 октября 2026 г.
Mistral Large 4: API уже доступен, веса — в конце октября

Mistral открыла public preview Mistral Large 4 — мультимодальной модели с 1 трлн параметров, из которых активно 49 млрд. В API её уже можно попробовать, но обещанные open weights появятся лишь в конце октября.

Reflection показала Beam на 501 млрд параметров — но веса выйдут позже
6 октября 2026 г.
Reflection показала Beam на 501 млрд параметров — но веса выйдут позже

Reflection представила Beam — открытую по весам MoE-модель для кода, рассуждений и агентов. Пока это ранний доступ: веса, model card и технический отчёт обещаны лишь позднее в октябре.

OpenAI начнёт маркировать тексты ChatGPT и Codex в ЕС
6 октября 2026 г.
OpenAI начнёт маркировать тексты ChatGPT и Codex в ЕС

OpenAI сообщила, что будет добавлять невидимую маркировку в тексты ChatGPT и Codex для пользователей из ЕС. Метка должна помочь выполнять требования AI Act, но компания признаёт: после существенной правки текста её будет труднее обнаружить.

GitHub открыла API для запуска проверок кода Copilot
5 октября 2026 г.
GitHub открыла API для запуска проверок кода Copilot

GitHub разрешила запускать проверку pull request’ов Copilot через REST и GraphQL API. Одновременно для новых и уже существующих репозиториев стандартным уровнем тщательности стал Balanced.

AWS показала Well-Architected Agent: ИИ-ревизор для облака, но с правами и проверкой человеком
5 октября 2026 г.
AWS показала Well-Architected Agent: ИИ-ревизор для облака, но с правами и проверкой человеком

AWS открыла предварительный доступ к Well-Architected Agent — сервису, который анализирует инфраструктуру и предлагает исправления для стоимости, производительности, устойчивости и безопасности. Рекомендации могут включать изменения IaC, но AWS отдельно предупреждает: генеративный ИИ способен ошибаться.

Google урезает доступ к Gemini: бесплатным оставят Flash-Lite
4 октября 2026 г.
Google урезает доступ к Gemini: бесплатным оставят Flash-Lite

Google меняет набор моделей Gemini для бесплатных пользователей и подписки AI Plus. С 9 октября доступ к Pro исчезнет у обоих уровней, а платный AI Pro получит Deep Think.