К списку моделей
Qwen: Qwen3.5-122B-A10B
ID: qwen/qwen3.5-122b-a10b
47,78 ₽
Запрос / 1М
382,26 ₽
Ответ / 1М
—
Изображение вход / 1М
—
Изображение выход / 1М
128K
Контекст
33K
Макс. ответ
Провайдеры для Qwen: Qwen3.5-122B-A10B
Venice
Статус
47,782 ₽Запрос / 1М
382,259 ₽Ответ / 1М
—Изображение вход / 1М
—Изображение выход / 1М
128KКонтекст
33KМакс. ответ
Дополнительные цены
—
Политика в отношении данных
Prompt Training:-
Prompt Logging:-
Moderation:Not moderated
Поддерживаемые параметры
reasoningВключает режим размышлений (chain-of-thought), где модель показывает ход рассуждений.include_reasoningВключает вывод рассуждений модели в ответ.max_tokensЭто устанавливает верхний предел для количества токенов, которые модель может генерировать в ответ. Больше этого предела выдаваться не будет. Максимальное значение - это длина контекста за вычетом длины запроса.temperatureУправляет случайностью ответа. Низкие значения (0.0–0.3) делают ответ более детерминированным, высокие (0.7–1.0) — более креативным.top_pNucleus sampling — ограничивает выбор токенов по совокупной вероятности. Значение 0.9 означает, что модель рассматривает только токены, составляющие 90% вероятности.stopСписок строк, при встрече которых модель прекращает генерацию.frequency_penaltyСнижает вероятность повторения уже использованных токенов.presence_penaltyПоощряет модель использовать новые темы в ответе.top_kОграничивает выбор токенов фиксированным количеством наиболее вероятных вариантов.
DeepInfra
Статус
27,714 ₽Запрос / 1М
229,356 ₽Ответ / 1М
—Изображение вход / 1М
—Изображение выход / 1М
262KКонтекст
82KМакс. ответ
Дополнительные цены
—
Политика в отношении данных
Prompt Training:-
Prompt Logging:-
Moderation:Not moderated
Поддерживаемые параметры
reasoningВключает режим размышлений (chain-of-thought), где модель показывает ход рассуждений.include_reasoningВключает вывод рассуждений модели в ответ.max_tokensЭто устанавливает верхний предел для количества токенов, которые модель может генерировать в ответ. Больше этого предела выдаваться не будет. Максимальное значение - это длина контекста за вычетом длины запроса.temperatureУправляет случайностью ответа. Низкие значения (0.0–0.3) делают ответ более детерминированным, высокие (0.7–1.0) — более креативным.top_pNucleus sampling — ограничивает выбор токенов по совокупной вероятности. Значение 0.9 означает, что модель рассматривает только токены, составляющие 90% вероятности.stopСписок строк, при встрече которых модель прекращает генерацию.frequency_penaltyСнижает вероятность повторения уже использованных токенов.presence_penaltyПоощряет модель использовать новые темы в ответе.repetition_penaltytop_kОграничивает выбор токенов фиксированным количеством наиболее вероятных вариантов.seedФиксирует генерацию для воспроизводимых результатов.min_presponse_formatЗадаёт формат ответа: текст или структурированный JSON.logit_biasstructured_outputsГарантирует, что ответ модели соответствует заданной JSON-схеме.
Ambient
Статус
28,669 ₽Запрос / 1М
229,356 ₽Ответ / 1М
—Изображение вход / 1М
—Изображение выход / 1М
262KКонтекст
66KМакс. ответ
Дополнительные цены
—
Политика в отношении данных
Prompt Training:-
Prompt Logging:-
Moderation:Not moderated
Поддерживаемые параметры
reasoningВключает режим размышлений (chain-of-thought), где модель показывает ход рассуждений.include_reasoningВключает вывод рассуждений модели в ответ.temperatureУправляет случайностью ответа. Низкие значения (0.0–0.3) делают ответ более детерминированным, высокие (0.7–1.0) — более креативным.max_tokensЭто устанавливает верхний предел для количества токенов, которые модель может генерировать в ответ. Больше этого предела выдаваться не будет. Максимальное значение - это длина контекста за вычетом длины запроса.frequency_penaltyСнижает вероятность повторения уже использованных токенов.logit_biasmin_ppresence_penaltyПоощряет модель использовать новые темы в ответе.repetition_penaltyseedФиксирует генерацию для воспроизводимых результатов.stopСписок строк, при встрече которых модель прекращает генерацию.top_kОграничивает выбор токенов фиксированным количеством наиболее вероятных вариантов.top_pNucleus sampling — ограничивает выбор токенов по совокупной вероятности. Значение 0.9 означает, что модель рассматривает только токены, составляющие 90% вероятности.response_formatЗадаёт формат ответа: текст или структурированный JSON.structured_outputsГарантирует, что ответ модели соответствует заданной JSON-схеме.logprobsВозвращает логарифмические вероятности выбранных токенов.top_logprobs
SiliconFlow
Статус
24,847 ₽Запрос / 1М
198,775 ₽Ответ / 1М
—Изображение вход / 1М
—Изображение выход / 1М
262KКонтекст
262KМакс. ответ
Дополнительные цены
—
Политика в отношении данных
Prompt Training:-
Prompt Logging:-
Moderation:Not moderated
Поддерживаемые параметры
reasoningВключает режим размышлений (chain-of-thought), где модель показывает ход рассуждений.include_reasoningВключает вывод рассуждений модели в ответ.temperatureУправляет случайностью ответа. Низкие значения (0.0–0.3) делают ответ более детерминированным, высокие (0.7–1.0) — более креативным.top_pNucleus sampling — ограничивает выбор токенов по совокупной вероятности. Значение 0.9 означает, что модель рассматривает только токены, составляющие 90% вероятности.top_kОграничивает выбор токенов фиксированным количеством наиболее вероятных вариантов.frequency_penaltyСнижает вероятность повторения уже использованных токенов.repetition_penaltypresence_penaltyПоощряет модель использовать новые темы в ответе.max_tokensЭто устанавливает верхний предел для количества токенов, которые модель может генерировать в ответ. Больше этого предела выдаваться не будет. Максимальное значение - это длина контекста за вычетом длины запроса.response_formatЗадаёт формат ответа: текст или структурированный JSON.structured_outputsГарантирует, что ответ модели соответствует заданной JSON-схеме.
Alibaba
Статус
24,847 ₽Запрос / 1М
198,775 ₽Ответ / 1М
—Изображение вход / 1М
—Изображение выход / 1М
262KКонтекст
66KМакс. ответ
Дополнительные цены
—
Политика в отношении данных
Prompt Training:-
Prompt Logging:-
Moderation:Not moderated
Поддерживаемые параметры
reasoningВключает режим размышлений (chain-of-thought), где модель показывает ход рассуждений.include_reasoningВключает вывод рассуждений модели в ответ.max_tokensЭто устанавливает верхний предел для количества токенов, которые модель может генерировать в ответ. Больше этого предела выдаваться не будет. Максимальное значение - это длина контекста за вычетом длины запроса.temperatureУправляет случайностью ответа. Низкие значения (0.0–0.3) делают ответ более детерминированным, высокие (0.7–1.0) — более креативным.top_pNucleus sampling — ограничивает выбор токенов по совокупной вероятности. Значение 0.9 означает, что модель рассматривает только токены, составляющие 90% вероятности.seedФиксирует генерацию для воспроизводимых результатов.presence_penaltyПоощряет модель использовать новые темы в ответе.response_formatЗадаёт формат ответа: текст или структурированный JSON.toolsПозволяет модели вызывать внешние функции (function calling) для получения данных или выполнения действий.tool_choiceУправляет тем, должна ли модель вызывать инструмент, и если да — какой именно.structured_outputsГарантирует, что ответ модели соответствует заданной JSON-схеме.logprobsВозвращает логарифмические вероятности выбранных токенов.top_logprobs
Novita
Статус
38,226 ₽Запрос / 1М
305,807 ₽Ответ / 1М
—Изображение вход / 1М
—Изображение выход / 1М
262KКонтекст
66KМакс. ответ
Дополнительные цены
—
Политика в отношении данных
Prompt Training:-
Prompt Logging:-
Moderation:Not moderated
Поддерживаемые параметры
reasoningВключает режим размышлений (chain-of-thought), где модель показывает ход рассуждений.include_reasoningВключает вывод рассуждений модели в ответ.max_tokensЭто устанавливает верхний предел для количества токенов, которые модель может генерировать в ответ. Больше этого предела выдаваться не будет. Максимальное значение - это длина контекста за вычетом длины запроса.temperatureУправляет случайностью ответа. Низкие значения (0.0–0.3) делают ответ более детерминированным, высокие (0.7–1.0) — более креативным.top_pNucleus sampling — ограничивает выбор токенов по совокупной вероятности. Значение 0.9 означает, что модель рассматривает только токены, составляющие 90% вероятности.stopСписок строк, при встрече которых модель прекращает генерацию.frequency_penaltyСнижает вероятность повторения уже использованных токенов.presence_penaltyПоощряет модель использовать новые темы в ответе.seedФиксирует генерацию для воспроизводимых результатов.top_kОграничивает выбор токенов фиксированным количеством наиболее вероятных вариантов.repetition_penaltytoolsПозволяет модели вызывать внешние функции (function calling) для получения данных или выполнения действий.tool_choiceУправляет тем, должна ли модель вызывать инструмент, и если да — какой именно.response_formatЗадаёт формат ответа: текст или структурированный JSON.logprobsВозвращает логарифмические вероятности выбранных токенов.top_logprobs
AtlasCloud
Статус
28,669 ₽Запрос / 1М
229,356 ₽Ответ / 1М
—Изображение вход / 1М
—Изображение выход / 1М
262KКонтекст
66KМакс. ответ
Дополнительные цены
28,669 ₽Кэш чтение / 1М
Политика в отношении данных
Prompt Training:-
Prompt Logging:-
Moderation:Not moderated
Поддерживаемые параметры
reasoningВключает режим размышлений (chain-of-thought), где модель показывает ход рассуждений.include_reasoningВключает вывод рассуждений модели в ответ.max_tokensЭто устанавливает верхний предел для количества токенов, которые модель может генерировать в ответ. Больше этого предела выдаваться не будет. Максимальное значение - это длина контекста за вычетом длины запроса.temperatureУправляет случайностью ответа. Низкие значения (0.0–0.3) делают ответ более детерминированным, высокие (0.7–1.0) — более креативным.top_pNucleus sampling — ограничивает выбор токенов по совокупной вероятности. Значение 0.9 означает, что модель рассматривает только токены, составляющие 90% вероятности.top_kОграничивает выбор токенов фиксированным количеством наиболее вероятных вариантов.min_pfrequency_penaltyСнижает вероятность повторения уже использованных токенов.presence_penaltyПоощряет модель использовать новые темы в ответе.repetition_penaltyseedФиксирует генерацию для воспроизводимых результатов.logit_biasresponse_formatЗадаёт формат ответа: текст или структурированный JSON.structured_outputsГарантирует, что ответ модели соответствует заданной JSON-схеме.toolsПозволяет модели вызывать внешние функции (function calling) для получения данных или выполнения действий.tool_choiceУправляет тем, должна ли модель вызывать инструмент, и если да — какой именно.
API и примеры кода
Наш сервис предоставляет единый API, совместимый с OpenAI SDK. Просто укажите наш base_url и используйте ключ, полученный
в личном кабинете.
