Gemini Omni
ВидеоGemini Omni — новая модель Google для генерации и редактирования видео с помощью обычного диалога. Google описывает её как аналог Nano Banana, только для видео: пользователь создаёт ролик, а затем продолжает общение с моделью и просит изменить отдельные детали.
Модель может принимать текст и изображения, создавать на их основе видео, а затем редактировать полученный результат. Например, можно попросить изменить материал предмета, удалить объект, заменить атмосферу или переделать отдельное действие. При этом не требуется заново описывать всю сцену.

Сильная сторона модели — понимание смысла. Ей необязательно подробно объяснять каждую мелочь: Gemini использует знания о реальном мире и старается самостоятельно дополнить сцену логичными деталями. Она умеет понимать рисунки, фотографии и текстовые объяснения, превращая их в связное видео.
Однако Gemini Omni Flash пока находится в предварительном доступе. Текущая версия API создаёт видео длительностью от 3 до 10 секунд в 720p. Загрузка аудиореференсов и продолжение сцены пока не поддерживаются. Google также предупреждает об ограничениях в сохранении персонажа при смене сцены и движении камеры. Работа с видеореференсами на момент публикации тоже реализована не полностью.
Поэтому Gemini Omni лучше подходит для экспериментов, визуальных эффектов и коротких сцен, чем для полноценного производства длинного клипа. Её главное преимущество — редактирование через разговор. Можно постепенно улучшать результат, не разбираясь в масках, слоях и сложных настройках видеоредактора.
Gemini Omni особенно полезна для:
- быстрого создания видео из идеи или изображения
- последовательного редактирования ролика
- визуальных эффектов и необычных превращений
- рекламных концептов
- коротких сюжетных и экспериментальных сцен
- пользователей, которые не хотят изучать сложные промты