Google запустила Gemini Omni: видео теперь можно редактировать разговором
Google представила Gemini Omni Flash — первую модель в новой семье Gemini Omni. Компания описывает ее как систему, где мультимодальное понимание Gemini соединяется с генерацией: пользователь может дать текст, изображение, видео или аудио и получить новый ролик, а затем править его обычными фразами. Запуск начинается с видео, но Google говорит, что позже семья Omni должна поддерживать и другие выходные форматы, включая изображения и аудио.
Сначала Gemini Omni Flash появляется в Gemini app, Google Flow и YouTube Shorts. Для подписчиков Google AI Plus, Pro и Ultra модель раскатывается глобально через Gemini и Flow, а в Shorts Remix и YouTube Create она будет доступна бесплатно с этой недели. В ближайшие недели Google обещает вывести Omni к разработчикам и корпоративным клиентам через API.
Монтаж без таймлайна
Самая понятная часть анонса — разговорное редактирование видео. Google показывает сценарии, где пользователь берет исходный ролик и просит изменить материал: сделать скульптуру из пузырей, поменять действие в сцене, добавить объект, перенести музыканта в другое окружение, изменить угол камеры или синхронизировать свет с музыкой. Важно, что правки могут идти цепочкой: каждая следующая команда опирается на предыдущую, а модель пытается сохранить персонажей, физику и контекст сцены.
Это отличается от привычной генерации ролика «с нуля». Для многих людей полезнее не получить случайный красивый клип, а взять свой материал и быстро довести его до нужного вида: убрать лишнее, сменить стиль, добавить эффект, превратить зарисовку в объясняющий ролик или адаптировать идею под короткое видео. Поэтому Omni особенно важна не как очередной конкурс красивых демо, а как шаг к монтажу через намерение, без обязательного знания профессионального интерфейса.
Почему YouTube здесь важен
Отдельный смысл запуска — YouTube Shorts. YouTube пишет, что Omni позволит ремиксовать подходящие Shorts: пользователь сможет добавить запросы и изображения, изменить сцену, вставить себя рядом с автором или развить чужой ролик в новом направлении, при этом контекст исходного видео должен сохраняться. Для платформы коротких видео это сильный ход: AI-монтаж становится не отдельным приложением, а частью привычного потока просмотра и ремикса.
Для создателей это одновременно возможность и новый источник напряжения. Видео станет проще переделывать, а значит идеи будут быстрее копироваться, стилизоваться и расходиться по платформам. Google обещает водяные знаки SynthID, Content Credentials, ссылки на оригинальный ролик, возможность отключить визуальный ремикс и расширение инструмента обнаружения likeness для авторов старше 18 лет. Эти ограничения не декоративны: чем дешевле становится убедительное видео, тем важнее понимать, откуда оно взялось и кто разрешил его использовать.
Что это меняет
Gemini Omni показывает, куда движется рынок генеративного видео после первых вау-роликов. Главная конкуренция смещается от «модель умеет сделать красивую сцену» к «модель умеет управляемо менять уже существующий материал». Для бизнеса, образования, рекламы, блогеров и обычных пользователей это практичнее: видео можно будет не только генерировать, но и исправлять итерациями, как текст в чате.
При этом Google пока аккуратно ограничивает обещания. Редактирование речи и звука за пределами собственных аватаров компания еще тестирует, API появится позже, а доступ и функции будут зависеть от подписки и региона. Но направление уже видно: AI-видео перестает быть отдельной лабораторной демонстрацией и становится частью массовых продуктов, где вопрос «как это сделать» постепенно заменяется вопросом «что именно я хочу изменить».













