Skip to main content
Gemini Omni Video — мультимодальная модель генерации видео от Google DeepMind. Поддерживает text-to-video, image-to-video (анимация изображения) и video-to-video (редактирование существующего ролика), разрешения 720p / 1080p / 4K, длительность 4 / 6 / 8 / 10 сек.
Полная документация API: Генерация медиа

Обзор

Режимы работы

Только текстовый промпт — модель генерирует ролик с нуля.

Параметры

Параметр async: true — обязателен для всех запросов: генерация видео возвращает id сразу, а готовый ролик приходит позже.

Пример запроса (cURL)

Асинхронная генерация

Генерация видео — асинхронный процесс. После отправки запроса вы получите id, который нужно использовать для проверки статуса:
1

Отправка запроса

POST на /api/v1/media возвращает id генерации
2

Проверка статуса

GET на /api/v1/media/{id} возвращает текущий статус
3

Получение результата

Когда статус completed, в ответе будет URL готового видео

Советы и лучшие практики

В промпте явно указывайте, что должно двигаться: «камера приближается», «объект вращается», «человек бежит». Без этого модель может выдать статичную сцену.
Большие значения duration (8–10 сек) и 4k заметно увеличивают время и стоимость генерации. Для тестов используйте 720p + duration: 4.
images[] и videos[] принимают публичные URL в формате { "type": "url", "data": "https://..." }. Для приватных файлов сначала загрузите их через /v1/storage/upload (см. Хранилище файлов).
Если нужно не генерировать с нуля, а подправить существующий ролик (добавить эффект, изменить темп, сменить стиль) — используйте режим video-to-video через videos[].

Следующие шаги

Статус генерации

Проверка статуса генерации медиа

Хранилище файлов

Загрузка изображений и видео