Обзор
Nano Banana 2 (кодовое имя) — это новейшая модель генерации изображений Google, выпущенная 26 февраля 2026 года, с ID моделиgemini-3.1-flash-image-preview. Она переосмысливает экономическую эффективность генерации изображений, обеспечивая качество уровня Pro при скорости и стоимости уровня Flash, что делает её новейшим флагманом серии Nano Banana.
-preview снят): Google обновила официальную документацию и выпустила стабильное название модели gemini-3.1-flash-image (без -preview). APIYI уже поддерживает его.- Старое название по-прежнему работает:
gemini-3.1-flash-image-previewпродолжает работать как обычно, тарификация без изменений, изменения кода не нужны. - Оба названия работают: используйте либо новое
gemini-3.1-flash-image, либо оригинальное название-preview.
API генерации изображений по тексту
API редактирования изображений
Пусть AI-агент выполнит интеграцию
.md к любому docs URL), затем пишет код в стеке вашего проекта — тайм-аут, защищённый разбор parts, сжатие при загрузке и параметры разрешения уже заложены в требования.Пусть coding agent выполнит интеграцию или отладку Nano Banana 2 для генерации изображений по тексту и редактирования изображений. Скопируйте и вставьте это в Codex, Claude Code, Cursor и аналогичные инструменты.
Что этот prompt избавляет вас от
Что этот prompt избавляет вас от
Почему Nano Banana 2 от APIYI?
Nano Banana Pro / 2 — модель №1 по объему использования на APIYI — стабильная, надежная и быстрая. Если вы хотите работать с профессиональной командой, APIYI — правильный выбор. Только что выпущенный флагман Google по-прежнему ограничен по мощности на стороне источника — APIYI глубоко оптимизирует опыт по направлениям надежности, стоимости и интеграции:Официальный канал · Как у Gemini
/v1beta/models/.../generateContent) и паттерном OpenAI SDK — тот же body запроса, те же поля ответа и коды ошибок. Миграция без кода.Без ограничений на параллельные запросы
28-36% от прайса Google
Глобальный доступ без барьеров
api.apiyi.com из материковых дата-центров, домашних сетей или зарубежных узлов. Стабильная задержка, без трансграничной переработки архитектуры.Полная линейка моделей
Профессиональная корпоративная поддержка
Ключевые возможности
Качество профессионального уровня
Вывод в 4K Ultra-HD
14 соотношений сторон
Привязка к поиску изображений
Точный рендеринг текста
Многораундовое редактирование
Режим рассуждения
Сохранение сходства
Сравнение версий
Цены
- Выберите Pay-as-you-go или Pay-as-you-go Priority → тарификация на основе token
- Выберите Pay-per-request или Pay-per-request Priority → тарификация за вызов (так же, как у Nano Banana Pro)
- ⚠️ НЕ выбирайте Hybrid billing
Тарификация за вызов
Тарификация на основе token (только для Nano Banana 2)
Оценка цен при тарификации на основе token
Три параметра, влияющих на тарификацию
Приведённые ниже цифры получены в ходе живого тестирования на рабочем шлюзе 2026-08-27 (12–20 прогонов на каждое условие, все значения основаны на фактических списаниях, зафиксированных в консоли, а не на оценках). Их влияние на ваш счёт различается на два порядка, поэтому оптимизируйте в указанном порядке.thinkingLevel: значение по умолчанию уже минимальное, а high стоит ещё на половину дороже
gemini-3.1-flash-image поддерживает управление уровнем thinking (Pro — нет). Один и тот же prompt, по 20 прогонов на каждое значение:
- Значение по умолчанию идентично
minimal— статистически неотличимо (p=0.64), так что явная передачаminimalничего не даёт. - Только при
highthoughtsTokenCountпоявляется как отдельное поле, и оно включается вcompletion_tokensи тарифицируется по тарифу генерации изображений. - Сложные prompt’ы начинают стоить дороже только после включения
high: на уровне по умолчанию prompt из 3 tokens и prompt с рассуждением из 98 tokens не показали значимой разницы в числе output tokens (p=0.37); сhighprompt с рассуждением использовал на 126% больше thinking tokens и стоил на 38% дороже за вызов.
Привязка Google Search: работает, но тарифицируется за каждый поисковый запрос
Для изображений, которым нужна актуальная информация для корректности (карточки погоды, рыночные графики, афиши событий), подключите инструментgoogleSearch. Привязка сработала во всех 12/12 прогонах.
Привязка Image Search: доступна только в Nano Banana 2, и пока бесплатно
searchTypes.imageSearch позволяет модели извлекать визуальные референсы из Google Image Search — полезно для сценариев «сделайте коллаж из реальных фотографий» или «нарисуйте это по реальному объекту».
- Подтверждается тем, что
imageSearchQueriesпоявляется вgroundingMetadata, со значениями вроде["current weather in Tokyo"]. - Пока дополнительная плата не взимается — стоимость одного вызова даже оказалась немного ниже, чем в контрольной группе без инструмента.
- Срабатывало в 7 из 12 прогонов: модель сама решает, искать или нет, она не делает запрос каждый раз.
- Веб-поиск и поиск изображений можно включить одновременно, но модель сама выбирает, что использовать, поэтому стоимость становится непредсказуемой.
responseModalities: ничего не экономит, но убирает нежелательный текст
responseModalities: ["IMAGE"] указывает, что вам нужны только изображения. По 20 прогонов на каждое значение:
- Все три значения отличаются менее чем на 1%, а
["TEXT","IMAGE"]полностью эквивалентен отсутствию поля (p=0.90). - При обычных prompt’ах для генерации 60/60 ответов уже содержали одну часть изображения и вообще не содержали текста, так что переключателю модальностей просто нечего делать. Только в reasoning prompt’ах (инфографика, data charts) примерно в трети случаев добавляется сводный абзац; здесь
["IMAGE"]подавляет его и экономит около 2.8% (p=0.09, статистически незначимо).
candidatesTokensDetails, но тарифицируется по полному тарифу и составляет 28% стоимости одного вызова, причём не зависит от длины prompt. На его фоне текст почти ничего не значит.Поэтому оценка стоимости одного изображения по 1120 tokens занижает её примерно на 28% — вместо этого сверяйте с candidatesTokenCount или totalTokenCount.Настройка групп
Nano Banana 2 поставляется с двумя группами на APIYI. Переключите в панели управления → Настройки Token:NanoBananaEnterprise, чтобы переждать всплеск.
Рекомендуемая модель тарификации: выберите Pay-as-you-go Priority — подходит и для тарификации Nano Banana 2 на основе token, и для тарификации Nano Banana Pro за вызов, один Token на всю серию.

Token settings: Billing model = Pay-as-you-go Priority, primary group = Default, fallback group = NanoBananaEnterprise (1.4x)
Поддерживаемые разрешения и соотношения сторон
Разрешения вывода
Поддерживаемые соотношения сторон (всего 14)
1:1, 1:4, 4:1, 1:8, 8:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9
Размеры вывода для каждого соотношения сторон (пиксели)
Таблица ниже перечисляет фактические размеры вывода Nano Banana 2 для всех 14 соотношений сторон на уровнях разрешения 512px / 1K / 2K / 4K (источник: официальная документация Google). В вашем запросе укажитеaspect_ratio для соотношения и image_size (или resolution) для уровня:
1:4, 4:1, 1:8, 8:1 — сверхвысокие по высоте/сверхширокие соотношения, идеально подходящие для длинных изображений и инфографики. Это также единственная модель с низким уровнем 512px, отлично подходящим для миниатюр и быстрых предпросмотров.Часто задаваемые вопросы
В чем разница между Nano Banana 2 и Nano Banana Pro?
В чем разница между Nano Banana 2 и Nano Banana Pro?
gemini-3.1-flash-image-preview) основан на Gemini 3.1 Flash, а Nano Banana Pro (gemini-3-pro-image-preview) — на Gemini 3 Pro. Ключевые различия:- ✅ Скорость: Nano Banana 2 быстрее (скорость уровня Flash)
- ✅ Цена: тарификация по token у Nano Banana 2 дешевле (от $0.025 против $0.09)
- ✅ Соотношения сторон: Nano Banana 2 поддерживает 14 (на 4 больше)
- ✅ Привязка к поиску изображений: эксклюзивно для Nano Banana 2
- ⚠️ Максимальное качество: Nano Banana Pro по-прежнему немного лучше
Стоит ли переходить с Nano Banana Pro на Nano Banana 2?
Стоит ли переходить с Nano Banana Pro на Nano Banana 2?
gemini-3-pro-image-preview на gemini-3.1-flash-image-preview.Стоит ли использовать gemini-3.1-flash-image-preview или версию с суффиксом -4k?
Стоит ли использовать gemini-3.1-flash-image-preview или версию с суффиксом -4k?
gemini-3.1-flash-image-preview (без суффикса -4k), а не gemini-3.1-flash-image-preview-4k.- Официальное название не содержит
-4k: официальное имя модели Google —gemini-3.1-flash-image-preview. Это также основной канал, на поддержание которого мы вкладываем больше всего ресурсов, поэтому он обеспечивает лучшую стабильность и совместимость. - Откуда взялось
-4k:gemini-3.1-flash-image-preview-4kизначально было конфигурацией, подготовленной для сценариев «chat-to-image» в клиентских приложениях для общения вроде Chatbox — генерации изображений прямо через чат в интерфейсе сообщений. - При работе через код + нативный формат Gemini лучше использовать общее имя: если вы вызываете через код, используя нативный формат Gemini (
/v1beta/models/.../generateContent), обычное имя моделиgemini-3.1-flash-image-previewстабильнее.
-4k — просто укажите разрешение 4K в параметрах запроса (см. выше «Поддерживаемые разрешения и соотношения сторон»).Что такое Image Search Grounding?
Что такое Image Search Grounding?
Что делает Thinking Mode?
Что делает Thinking Mode?
high дает наилучшие результаты, но немного увеличивает время генерации. Лучше всего подходит для задач, требующих точной композиции, отрисовки текста или сложных сцен.Сколько времени занимает генерация изображения?
Сколько времени занимает генерация изображения?
- 1K resolution: ~5-10 секунд
- 2K resolution: ~10-15 секунд
- 4K resolution: ~15-25 секунд
- Включение высокого режима рассуждения добавляет еще несколько секунд
Есть ли лимит параллельных запросов? API обрабатывает запросы последовательно? Что делать, если мне нужно, чтобы 20 пользователей обратились одновременно?
Есть ли лимит параллельных запросов? API обрабатывает запросы последовательно? Что делать, если мне нужно, чтобы 20 пользователей обратились одновременно?
timeout: генерация изображений (особенно 4K или в период пиковых нагрузок) может занимать некоторое время на каждый запрос, поэтому установите таймаут клиента на 360 секунд, чтобы не обрывать запросы, которые нормально обрабатываются.Какие форматы входных изображений поддерживаются?
Какие форматы входных изображений поддерживаются?
image/png и image/jpeg. Загрузка возможна через кодировку base64 или API для файлов.Есть ли на выходных изображениях водяные знаки?
Есть ли на выходных изображениях водяные знаки?
Почему я получаю connection reset by peer / write_response_body_failed (500)?
Почему я получаю connection reset by peer / write_response_body_failed (500)?
- Ограничьте количество изображений: соблюдайте официальные правила (максимум 14 изображений на prompt) — не добавляйте слишком много референсных изображений.
- Ограничьте размер каждого изображения: держите каждое изображение меньше 5MB — официальный лимит на одно изображение составляет 7MB, а кодирование base64 увеличивает размер примерно на 1/3, поэтому оставляйте запас.
- Сжимайте на frontend перед загрузкой: сжимайте изображения на frontend (или на сервере-посреднике) перед отправкой в API — обычная практика заключается в ограничении длинной стороны, конвертации в JPEG/WebP и настройке параметра качества.
- Перейдите на ввод через URL: нативный формат Gemini поддерживает передачу URL изображения через
fileData.fileUri, полностью обходя слишком большие тела запросов base64 — см. Руководство разработчика Nano Banana.
Связанная документация
- Генерация изображений Nano Banana Pro - Предыдущая флагманская версия
- Редактирование изображений Nano Banana - Возможности редактирования изображений
- Сравнительное тестирование генерации изображений
- Руководство по использованию API