Что это за модель
Gemini Omni Google DeepMind показала на Google I/O 19 мая 2026 года. Первым вышел выпуск Gemini Omni Flash, сейчас актуальна версия 1.1 Flash. Модель принимает на вход текст, картинки, короткие видео и звук, а на выходе даёт ролик со звуком.
Главное отличие от прошлых видеомоделей Google — разговорная правка. Готовый клип не нужно генерировать заново: достаточно написать «сделай ночь» или «убери человека слева», и модель изменит именно это, сохранив остальную сцену и персонажа.
Где работает Gemini Omni
По странице модели на сайте DeepMind, Omni встроена сразу в несколько продуктов Google. Обычному пользователю проще всего начать в приложении Gemini или в Google Flow — там нужна подписка Google AI.
Бесплатно модель раскатывают внутри YouTube Shorts и YouTube Create. Разработчики подключают её через Google AI Studio, Gemini API и облако Google — там оплата идёт за секунды видео, ориентир около 0,10 $ за секунду.
- приложение Gemini — по подписке Google AI Plus, Pro или Ultra, видео расходует кредиты;
- Google Flow — инструмент для сборки роликов из сцен;
- YouTube Shorts и YouTube Create — короткие видео для канала;
- Google Vids, AI Studio и Gemini API — для работы и разработки.
Как создать видео в Gemini Omni
Войдите в аккаунт Google
Отдельной регистрации у Omni нет: вход идёт через Google-аккаунт в том продукте, где вы её запускаете.
Опишите сцену или приложите материал
Можно начать с текста, с фото или с короткого видео — модель учитывает до нескольких секунд исходного ролика.
Получите первый вариант
За один запуск модель делает клип до 10 секунд со звуком.
Правьте словами
Пишите, что изменить: свет, погоду, одежду героя, лишний объект в кадре. Каждая правка сохраняет остальную сцену.
Продлите и скачайте
Сцену можно продлить, увеличить разрешение до 4K и выгрузить MP4.
Как писать запрос
Лучше всего работает описание в формате «кто — что делает — где — как движется камера — какой звук». Например: «рыжий кот прыгает на подоконник, вечер, камера медленно приближается, слышен дождь». Русский язык модель понимает, но короткие точные фразы дают более предсказуемый результат.
Для правки не пересказывайте всю сцену — называйте одно изменение за раз. Так проще понять, что именно модель поменяла, и откатиться, если стало хуже.
Ограничения
Россия не входит в список стран, где доступно приложение Gemini, а подписку Google AI не оплатить российской картой. YouTube в России работает с перебоями, поэтому и бесплатный путь через Shorts не всегда удобен.
За один запуск ролик получается не длиннее 10 секунд. Более длинное видео собирают из нескольких сцен или продлением — каждое продление тоже тратит кредиты.
Чем Omni отличается от Veo
Veo 3.1 — прошлая видеомодель Google, которая по-прежнему работает во Flow, AI Studio и по API. Она генерирует ролик по описанию, и каждый новый вариант — это новая генерация. Omni же воспринимает готовый клип как материал, который можно дорабатывать шаг за шагом.
В приложении Gemini видео теперь делает именно Omni. Если в старых инструкциях упоминается Veo внутри Gemini, считайте, что там уже работает новая модель.
Когда быстрее через ИИ-агента
Самой Gemini Omni в ИИ-агенте LeanTech нет. Но короткий ролик по описанию или из фото агент делает другими моделями: Kling 3 и Hailuo 2.3 — на тарифах Pro и Power, Veo 3.1 той же Google и Seedance 2.5 со звуком — только на Power. Оплата картой РФ, без VPN.
Чего агент не делает: разговорной правки готового клипа, как в Omni, у него нет — изменения идут новой генерацией по уточнённому описанию. Публиковать ролик в YouTube агент тоже не умеет, он отдаёт файл MP4.