Polza.AI
Polza.ai Logo

Начните пользоваться прямо сейчас

Единый API для 400+ моделей ИИ. Создавайте тексты, код, изображения, аудио и видео в одном интерфейсе.

TelegramXInstagramYouTubeVK
© 2025–2026 Polza Ai • Все права защищены
К списку моделей
Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)

Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)

ID: google/gemini-3.1-flash-image-preview

Попробовать

от 4,8 до 10,8 ₽/ изобр.

Изображение

66K

Контекст

Макс. ответ

Провайдеры для Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)

mie

Статус

от 4,8 ₽ до 10,8 ₽ / изобр.Изображение

Детальные цены

1K4,8
2K7,2
4K10,8

Дополнительные цены

Политика в отношении данных

Prompt Training:-
Prompt Logging:-
Moderation:Not moderated

Поддерживаемые параметры

Нет данных

bananalab

Статус

от 4,8 ₽ до 10,8 ₽ / изобр.Изображение

Детальные цены

1K4,8
2K7,2
4K10,8

Дополнительные цены

Политика в отношении данных

Prompt Training:-
Prompt Logging:-
Moderation:Not moderated

Поддерживаемые параметры

Нет данных

google-ai-studio

Статус

56,98 ₽Запрос / 1М
341,881 ₽Ответ / 1М
Изображение вход / 1М
6 837,624 ₽Изображение выход / 1М

Дополнительные цены

1 595,446 ₽Веб-поиск / 1K

Политика в отношении данных

Prompt Training:-
Prompt Logging:-
Moderation:Not moderated

Поддерживаемые параметры

reasoninginclude_reasoningmax_tokenstemperaturetop_pseedresponse_formatstructured_outputsreasoning_effort

google-vertex/global

Статус

56,98 ₽Запрос / 1М
341,881 ₽Ответ / 1М
Изображение вход / 1М
6 837,624 ₽Изображение выход / 1М

Дополнительные цены

1 595,446 ₽Веб-поиск / 1K

Политика в отношении данных

Prompt Training:-
Prompt Logging:-
Moderation:Not moderated

Поддерживаемые параметры

reasoninginclude_reasoningmax_tokenstemperaturetop_pseedresponse_formatreasoning_effort

google-vertex/global/flex

Статус

28,49 ₽Запрос / 1М
170,941 ₽Ответ / 1М
Изображение вход / 1М
3 418,812 ₽Изображение выход / 1М

Дополнительные цены

1 595,446 ₽Веб-поиск / 1K

Политика в отношении данных

Prompt Training:-
Prompt Logging:-
Moderation:Not moderated

Поддерживаемые параметры

reasoninginclude_reasoningmax_tokenstemperaturetop_pseedresponse_formatreasoning_effort

Параметры генерации

Промптprompt
Обязательный
Максимально 20000 символов
Соотношение сторонaspect_ratio
Соотношение сторон
1:12:33:23:44:34:55:49:1616:921:9auto
Форматoutput_format
Формат файла
pngjpeg
Изображенияimages
Входные изображения для обработки
0-14
Разрешениеimage_resolution
1K2K4K

API и примеры кода

Редактирование с референсным изображением

Запрос отправляется на Media API (POST /api/v1/media). Поля в input в примере ниже совпадают с таблицей «Параметры генерации».

Подробнее о «Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)»

Генерирует изображения в разрешении до 4K с задержкой 4–6 секунд. Подходит для высоконагруженных задач, требующих точной типографики и сохранения консистентности объектов.

Технический обзор Gemini 3.1 Flash Image Preview (Nano Banana 2)

1. Введение и общее описание

Gemini 3.1 Flash Image Preview, известная в сообществе разработчиков под кодовым названием «Nano Banana 2», является новейшим достижением Google DeepMind в области генеративной нейросети для создания и редактирования визуального контента. Релиз модели, состоявшийся 26 февраля 2026 года, ознаменовал важный этап в развитии мультимодальных систем: теперь топовое качество изображений стало доступным при беспрецедентной скорости отклика.

Модель позиционируется как оптимальное решение для продакшн-систем, где требуется баланс между «студийным» качеством 4K-разрешения и низкой задержкой (Flash-уровень производительности). Нативно мультимодальная архитектура позволяет модели не просто создавать картинки по текстовому описанию, но и глубоко понимать контекст, сохранять целостность персонажей и объектов на серии изображений, а также филигранно отрисовывать текстовые элементы внутри графики.

  • Тип модели: Нативно мультимодальная архитектура генерации изображений.
  • Контекстное окно: 65 536 токенов.
  • Целевая аудитория: Разработчики приложений для создания контента, дизайнеры, внедряющие ИИ-автоматизацию, и enterprise-компании, нуждающиеся в экономичных, но высококачественных визуальных решениях.

2. Технические характеристики

  • Архитектура: Модель базируется на улучшенной архитектуре Gemini 3.1, ориентированной на Flash-инференс. Она использует плотную (dense) структуру, оптимизированную для параллельной трансформации текстовых эмбеддингов в визуальные признаки с минимальными вычислительными затратами.
  • Разрешение: Поддержка генерации от 1K до 4K, что выводит модель за рамки стандартных Flash-решений предыдущих поколений.
  • Контекстное окно и вывод: Стандартное окно в 65 536 токенов обеспечивает глубокое понимание контекста длинных сессий, а максимальный объем вывода (completion) также достигает 65 536 токенов, что позволяет генерировать сложные метаданные и описания к изображениям без обрывов.
  • Языковая поддержка: Модель поддерживает более 100 ведущих мировых языков благодаря мультиязычному обучению базовой архитектуры Gemini 3.1, что гарантирует точное следование промптам на большинстве языков мира.
  • Интеграция: Доступ к модели осуществляется через Gemini API и платформу Vertex AI. Параметры соотношения сторон и конфигурация генерации изображения управляются через специализированные API-параметры image_config.

3. Показатели производительности (бенчмарки)

Хотя Gemini 3.1 Flash Image Preview в первую очередь является моделью генерации изображений, она наследует мощные лингвистические способности семейства Gemini 3.1. Согласно blog.laozhang.ai, модель демонстрирует впечатляющие для своего класса показатели:

  • Качество изображений (CLIPScore): 0,319. Этот показатель подтверждает высокую корреляцию между текстовым промптом пользователя и финальным визуальным результатом.
  • Точность рендеринга текста: Модель считается лидером в отрисовке типографики внутри изображений, опережая предыдущие модели поколения Nano Banana Pro.
  • Скорость (Latency): Генерация кадра занимает от 4 до 6 секунд, что примерно в 5-10 раз быстрее, чем у моделей Pro-класса (у которых время ожидания варьируется от 20 до 60 секунд).

В задачах рассуждения и логики, как часть экосистемы Gemini 3.1, модель уверенно справляется с классическими бенчмарками (MMLU, GSM8K), обеспечивая быстрое понимание инструкций even в условиях сложного, многоуровневого промптинга.

4. Ключевые возможности

  1. Консистентность объектов и персонажей: Модель способна отслеживать до 5 персонажей и 14 различных объектов внутри одного рабочего процесса, сохраняя их параметры неизменными на протяжении всей генерации.
  2. Типографика высокого уровня: Способность безошибочно интегрировать длинные строки текста в макеты интерфейсов, инфографику и плакаты.
  3. Real-time Grounding: Быстрая привязка знаний из интернета к генерируемому контенту в режиме реального времени.
  4. Редактирование изображений: Модель отлично справляется с задачей «Image-to-Image», принимая на вход изображение и выполняя правки на основе команд на естественном языке.
  5. Нативная мультимодальность: Способность модели «видеть» и «слышать» контекст, что делает её идеальной для сложных креативных задач.

Пример сценария (Use Case: Контент для соцсетей): Промпт: «Создай рекламный баннер для кофейни в стиле минимализм, 4K, где на переднем плане чашка латте с логотипом 'BeanSpot', написанным аккуратным шрифтом, с соблюдением текстуры дерева на столе». Результат: Модель выдает изображение с идеальной типографикой логотипа, что раньше было критической проблемой для большинства ИИ-моделей.

5. Оптимальные случаи использования

Nano Banana 2 — это выбор прагматиков. Она идеально подходит для:

  • Автоматизированной генерации контента для соцсетей.
  • Создания элементов интерфейса (UI/UX прототипирование).
  • Масштабируемой верстки рекламных материалов.
  • Интерактивных RAG-систем, требующих визуализации данных.
Кому подходит идеальноКому не стоит использовать
Разработчикам высоконагруженных APIХудожникам, ищущим специфические стилистические изыски
Маркетинговым агентствам (масс-контент)Тем, кому нужна сверхдлинная последовательная генерация видео (лучше брать модели серии Pro/Ultra)
Создателям чат-ботов с поддержкой ИЗОРазработчикам, работающим в средах с полным отсутствием интернета (требуется доступ к Gemini API)

6. Ограничения

Несмотря на технологическое совершенство, модель имеет ряд ограничений:

  • Цензура и политики безопасности: Как и все модели от Google, Nano Banana 2 имеет жесткие фильтры на генерацию небезопасного или этически сомнительного контента.
  • Галлюцинации: Хотя контекстное окно велико, при генерации чрезмерно сложных сцен с множеством мелких деталей модель может допускать геометрические искажения.
  • Зависимость от API: Модель не является локальной (open-weights) для установки на собственное железо пользователя; работа возможна только через удаленные серверы, что накладывает требования к сетевому соединению.
  • Тонкая настройка: На текущий момент модель имеет меньше возможностей для глубокого "fine-tuning" (дообучения) под конкретный стиль заказчика по сравнению с более тяжелыми моделями семейства Gemini 3 Pro.

Gemini 3.1 Flash Image Preview (Nano Banana 2) — это инструмент, который кардинально меняет подход к генеративной визуализации, предлагая разработчикам мощность, ранее доступную только в премиум-сегменте, и скорость, необходимую для современного интернета.

Выбор за вами
Polza.AI Logo

Polza.AI — лучший выбор

для

Воспользуйтесь сервисом прямо сейчас

Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview) — цены, контекст, API | Polza AI