Skip to main content
В этом гайде вы узнаете как отправлять текстовые запросы к AI моделям и получать ответы.
Полная документация endpoint доступна в API Reference.

Endpoint

Отправляет диалог (массив сообщений) в модель и получает ответ.

Базовые параметры

* Укажите messages или prompt. При передаче prompt он автоматически преобразуется в messages с ролью user.

Дополнительные параметры

Структура messages

Каждое сообщение содержит роль и содержимое:

Роли сообщений

Типы content

Поле content может быть строкой или массивом content parts для передачи медиа:
Подробнее о передаче медиа — в гайде Передача медиа на вход.

Простой пример

Структура ответа

Описание полей ответа

Значения finish_reason

Стриминг

Для получения ответа по мере генерации установите stream: true. Ответ приходит в формате Server-Sent Events (SSE):

Пример диалога

Для ведения диалога передавайте историю сообщений:

Советы по использованию

System message задаёт контекст и поведение модели. Например:
  • «Ты опытный Python-разработчик»
  • «Отвечай кратко, в 2-3 предложениях»
  • «Всегда приводи примеры кода»
  • Низкая (0.0-0.3) — для точных, детерминированных ответов (код, факты)
  • Средняя (0.5-0.7) — баланс между точностью и разнообразием
  • Высокая (0.8-1.0) — для креативных задач (тексты, идеи)
Установка max_tokens помогает:
  • Экономить средства на коротких ответах
  • Ускорять время ответа
  • Контролировать длину генерации

Следующие шаги

Передача медиа

Изображения, документы, аудио и видео на вход

Tool Calling

Вызов функций из модели

Structured Output

JSON-ответы с гарантированной структурой

Выбор провайдера

Управление роутингом между провайдерами