Эта страница предлагает готовый к использованию Agent Skill: просто добавьте его в используемый вами агент для программирования, и вы сможете вызывать APIYI’s Nano Banana 2 Lite (
gemini-3.1-flash-lite-image) на естественном языке (или с явными командами), чтобы генерировать и редактировать изображения. Всё это — всего два файла: скопируйте и сразу начинайте.Что делает этот навык
Единый объединенный навык — скрипт автоматически определяет, передаются ли изображения, чтобы выбрать между «текст в изображение» и «редактирование изображения»:Текст в изображение
Только prompt → создается совершенно новое изображение с поддержкой 14 соотношений сторон, холстом 1K, ~4s на изображение.
Редактирование изображения
Передайте одно изображение + инструкцию → локальные правки, перенос стиля, замена фона и т. д.
Композиция нескольких изображений
Передайте несколько изображений + одну инструкцию → компоновка, сравнение, замена одежды и многое другое.
Какие агенты могут это использовать
По сути, Skill — это просто папка: описание, написанное для агента (
SKILL.md), + скрипт, который выполняет работу. Поэтому любой кодирующий агент, который может читать локальные файлы и запускать командную строку, может использовать его — например, Codex, OpenClaw, hermes-agent, Claude Code и другие.Единственное требование: на машине, где запущен агент (ваш компьютер или сервер), должен быть установлен Python 3 и быть доступ в интернет (скрипт подключается напрямую к api.apiyi.com). И все — никакой конкретный агент не требуется.Установите в три шага
① Создайте папку, вставьте файлы
Создайте папку skill и добавьте два файла ниже (полное содержимое — в следующих двух разделах):② Добавьте свой ключ в ту же папку
Вnano-banana-lite/.env добавьте свой APIYI API-ключ (созданный в консоли api.apiyi.com):
.env — никакой дополнительной настройки или переменных окружения не требуется.
③ Передайте это агенту
- Агенты с автоматическим обнаружением skill (например, Claude Code): поместите всю папку
nano-banana-lite/в его каталог skills — пользовательский~/.claude/skills/или проектный.claude/skills/(общий для репозитория). - Другие агенты: разместите его в соответствии с их собственными правилами для skill/plugin; или, проще всего, — просто скажите агенту «прочитай SKILL.md в этой папке и следуй ему».
SKILL.md
Создайтеnano-banana-lite/SKILL.md с полным содержимым ниже (description указывает «что он делает + когда использовать», что агент использует для автозапуска):
scripts/nano_banana_lite.py
Создайтеnano-banana-lite/scripts/nano_banana_lite.py в нативном формате Gemini (идентично коду text-to-image / image-editing на этом сайте, проверено и работает). Только стандартная библиотека Python — никаких pip install не требуется:
Почему одно предложение генерирует изображение
Многих это удивляет: я не вводил команду, так почему фраза «нарисуй кота» создает изображение? Вот как это работает: когда агент запускается, он сначала читаетdescription в SKILL.md каждого навыка (короткий фрагмент метаданных, который сообщает «что делает этот навык и когда его использовать»). Когда ваш запрос соответствует этому сценарию описания (например, «нарисуй/сгенерируй/отрендери изображение», «измените это изображение на…»), агент автоматически решает вызвать этот навык, читает полный SKILL.md и запускает скрипт — и все это без необходимости запоминать какие-либо команды.
Итак:
- Хорошо написанный
description= более точное автоматическое срабатывание. Описание этого навыка уже охватывает формулировки вроде «сгенерируй/нарисуй/отредактируй/собери изображение». - Когда вы не хотите, чтобы агент гадал, и хотите 100% контроля, используйте явный вызов ниже.
Как использовать
Естественный язык (неявный триггер)
После установки просто обращайтесь к агенту:Явный вызов (больше контроля)
Если вы не хотите, чтобы агент решал за вас, есть два явных варианта:-
Агенты с slash-командами (например, Claude Code):
-
Любой агент / просто скажите ему запустить скрипт (наиболее универсально):
Где находятся сгенерированные изображения
- Когда
-o— это только имя файла (например,-o dog.png), изображения сохраняются в папкуnano-banana-output/в корне проекта (создаётся автоматически), так что вы найдёте их прямо там, в проекте. - «Корень проекта» = первый каталог, содержащий
.gitили.claude, найденный при подъёме вверх от скрипта — независимо от того, в каком каталоге запускается агент, изображения сохраняются внутри проекта, а не во временном каталоге, где их можно было бы потерять. - Скрипт выводит полный абсолютный путь для каждого изображения, например
Image saved to /Users/you/project/nano-banana-output/dog.png. - По умолчанию создаётся только 1 изображение;
-n 3выводит 3 сразу (максимум 5, автоматически ограничивается выше этого значения), с суффиксами-1,-2,-3, добавляемыми к имени файла. - Когда вы передаёте путь с каталогом (например,
-o images/dog.pngили абсолютный путь), он сохраняется по указанному вами пути (относительные пути считаются относительно текущего рабочего каталога), а не вnano-banana-output/. - Редактирование изображений работает так же: результат — новый файл, и он никогда не перезаписывает исходный.
Nano Banana 2 Lite имеет строгие средства контроля безопасности контента. Если скрипт сообщает
finishReason, отличное от STOP, или возвращает текст отклонения, скорректируйте контент в соответствии с сообщением — не пытайтесь повторно запускать тот же самый нарушающий prompt.