Skip to main content
Gemini Omni 1.1 Flash — лёгкая модель генерации видео от Google DeepMind из линейки Gemini Omni. Поддерживает text-to-video, image-to-video, video-to-video и first-and-last-frames → video, длительность 4 / 6 / 8 / 10 сек, разрешения 360p / 720p / 1080p / 4k, генерация со звуком.
Полная документация API: Генерация медиа

Обзор

Режимы работы

Только текстовый промпт — модель генерирует ролик с нуля.

Параметры

Параметр async: true — обязателен для всех запросов: генерация видео возвращает id сразу, а готовый ролик приходит позже.

Пример запроса (cURL)

Асинхронная генерация

Генерация видео — асинхронный процесс. После отправки запроса вы получите id, который нужно использовать для проверки статуса:
1

Отправка запроса

POST на /api/v1/media возвращает id генерации
2

Проверка статуса

GET на /api/v1/media/{id} возвращает текущий статус
3

Получение результата

Когда статус completed, в ответе будет URL готового видео

Советы и лучшие практики

В промпте явно указывайте, что должно двигаться: «камера приближается», «объект вращается», «человек бежит». Без этого модель может выдать статичную сцену.
Большие значения duration (8–10 сек) и 4k заметно увеличивают время и стоимость генерации. Для тестов используйте 720p + duration: 4.
images[] и videos[] принимают публичные URL в формате { "type": "url", "data": "https://..." }. Для приватных файлов сначала загрузите их через /v1/storage/upload (см. Хранилище файлов).
Суммарное число референсов ограничено: images + videos×2 + character_ids ≤ 7. Если передать больше — модель вернёт ошибку.
first_frame_url и last_frame_url — это самостоятельный режим. Их нельзя использовать вместе с images, videos, audio_ids или character_ids.

Следующие шаги

Статус генерации

Проверка статуса генерации медиа

Хранилище файлов

Загрузка изображений и видео