Skip to main content
POST
Создать генерацию медиа

О Media API

Универсальный эндпоинт для генерации медиа контента. Поддерживает различные модели и провайдеров через единый интерфейс.

Общие параметры

Передача файлов (URL и base64)

Для моделей, поддерживающих image-to-image или video-to-video, медиа файлы передаются в массиве images или videos. Каждый элемент — объект с полями:

Пример с base64

Можно комбинировать URL и base64 в одном запросе:
Base64 поддерживается как с data URI (data:image/png;base64,...), так и без — просто строка base64. Если провайдер не поддерживает base64 напрямую, файл автоматически загружается в хранилище и передаётся как URL.

Типы контента

  • Изображения (Nano Banana, Seedream, GPT Image и др.)
  • Видео (Veo, Wan, Kling, Seedance, Sora и др.)
  • Аудио — синтез речи (TTS) и распознавание речи (STT)

Хранение результатов

При генерации медиа контента Polza.ai автоматически:
  1. Скачивает результат у AI провайдера на собственное хранилище
  2. Хранит файлы 7 дней для повторного доступа
  3. Раздаёт через CDN для быстрого доступа внутри России
После истечения 7 дней файлы автоматически удаляются. Для постоянного хранения используйте Storage API с политикой PERMANENT.

Руководства по моделям

Подробные примеры, параметры и особенности каждой модели — в руководствах:

Видео

Veo 3.1, Wan 2.5/2.6, Kling, Seedance, Sora и другие модели видеогенерации

Изображения

Seedream, Nano Banana, GPT Image, Flux, Grok Imagine и другие модели генерации изображений

Аудио

ElevenLabs TTS и другие модели синтеза и распознавания речи

Ответ

Возвращает объект Media Status со статусом pending:
Используйте GET /v1/media/ для проверки статуса и получения результата.

Авторизации

Authorization
string
header
обязательно

API ключ передаётся в заголовке: Authorization: Bearer <POLZA_AI_API_KEY>

Тело

application/json
model
string
обязательно

ID модели для генерации

Пример:

"seedream-3"

input
Изображение · object
обязательно

Входные параметры генерации

provider
object

Настройки роутинга провайдеров

async
boolean
по умолчанию:false

Асинхронный режим генерации. При true возвращается taskId для опроса статуса

Пример:

false

user
string

Уникальный идентификатор конечного пользователя для отслеживания и предотвращения злоупотреблений

Пример:

"user-123"

Ответ

id
string
обязательно

Уникальный идентификатор генерации

Пример:

"gen_581761234567890123"

object
string
обязательно

Тип объекта

Пример:

"media.generation"

status
enum<string>
обязательно

Статус генерации

Доступные опции:
pending,
processing,
completed,
failed,
cancelled
Пример:

"pending"

created
number
обязательно

Временная метка создания (Unix timestamp)

Пример:

1703001234

model
string
обязательно

ID модели, которая генерирует контент

Пример:

"google/gemini-2.5-flash-image"

completed_at
number

Временная метка завершения (Unix timestamp)

Пример:

1703001244

data

Данные сгенерированного контента

usage
object

Информация об использовании ресурсов

error
object

Информация об ошибке (если failed)

content
string

Текстовый ответ модели (если вернула текст вместо/вместе с изображением)

Пример:

"Банан и яблоко — это фрукты."

reasoning_summary
string

Краткое резюме рассуждений модели

Пример:

"Preparing image generation prompt with camera settings..."

warnings
string[]

Предупреждения (неподдерживаемые параметры и т.д.)

Пример: