Skip to main content
POST
Создать генерацию изображения (OpenAI-совместимый API)
OpenAI-совместимый эндпоинт для генерации изображений. Поддерживает формат запросов GPT image models, DALL-E 3, DALL-E 2.
Этот эндпоинт совместим с OpenAI SDK и подходит для быстрой миграции существующего кода. Если вы разрабатываете новый софт — рекомендуем использовать Media API, который предоставляет единый интерфейс для всех медиа-операций.
Этот эндпоинт доступен по пути /v2/images/generations. При использовании OpenAI SDK с base_url="https://polza.ai/api/v1" запросы автоматически направляются на правильный путь.

Параметры

Обязательные

Опциональные

size

Размер генерируемого изображения:

quality

Качество генерации:

Примеры

Поведение при таймауте

Генерация выполняется синхронно с таймаутом 120 секунд.

Успешная генерация (до 120 сек)

Возвращается объект с результатом:

Таймаут (более 120 сек)

Если генерация не успевает завершиться за 120 секунд, запрос автоматически переходит в асинхронный режим:
Используйте GET /v1/media/{id} для проверки статуса. Рекомендуется polling с интервалом 3-5 секунд.

Статусы генерации

Авторизации

Authorization
string
header
обязательно

API ключ передаётся в заголовке: Authorization: Bearer <POLZA_AI_API_KEY>

Тело

application/json
model
string
обязательно

ID модели для генерации изображений

Пример:

"dall-e-3"

prompt
string
обязательно

Текстовое описание изображения для генерации (до 32000 символов для GPT image models, 4000 для dall-e-3)

Пример:

"A white siamese cat sitting on a windowsill"

n
number
по умолчанию:1

Количество генерируемых изображений (1-10, для dall-e-3 только 1)

Требуемый диапазон: 1 <= x <= 10
Пример:

1

size
enum<string>
по умолчанию:auto

Размер генерируемого изображения. auto для GPT image models

Доступные опции:
auto,
256x256,
512x512,
1024x1024,
1536x1024,
1024x1536,
1792x1024,
1024x1792
Пример:

"auto"

quality
enum<string>
по умолчанию:auto

Качество изображения. auto/high/medium/low для GPT image models, hd/standard для DALL-E

Доступные опции:
auto,
low,
medium,
high,
standard,
hd
Пример:

"auto"

response_format
enum<string>
по умолчанию:url

Формат ответа - URL или base64-encoded JSON

Доступные опции:
url,
b64_json
Пример:

"url"

style
enum<string>
по умолчанию:vivid

Стиль изображения (только для dall-e-3)

Доступные опции:
vivid,
natural
Пример:

"vivid"

output_format
enum<string>

Формат выходного изображения (для gpt-image-1)

Доступные опции:
png,
jpeg,
webp
Пример:

"png"

background
enum<string>

Фон изображения: transparent, opaque или auto (для gpt-image-1)

Доступные опции:
transparent,
opaque,
auto
Пример:

"auto"

output_compression
number

Степень сжатия выходного изображения (0-100, для gpt-image-1)

Требуемый диапазон: 0 <= x <= 100
Пример:

75

user
string

Уникальный идентификатор конечного пользователя для отслеживания и предотвращения злоупотреблений

Пример:

"user-123"

Ответ

Успешная генерация изображения. При таймауте (>120 сек) возвращается ImagePendingResponsePresenter с taskId для проверки статуса через GET /v2/media/{id}

created
number
обязательно

Unix timestamp времени создания

Пример:

1589478378

data
object[]
обязательно

Массив сгенерированных изображений

usage
object

Информация об использовании ресурсов