이 페이지는 바로 사용할 수 있는 Agent Skill을 제공합니다. 이미 사용 중인 코딩 에이전트에 그대로 넣고, 자연어(또는 명시적인 명령)를 사용하여 APIYI 플랫폼에서 이미지 생성 및 편집용 Nano Banana 2 (
gemini-3.1-flash-image-preview)를 호출하십시오. 전체는 단 두 파일뿐이므로, 복사해서 바로 사용하면 됩니다.이 스킬의 기능
하나로 결합된 스킬입니다. 스크립트가 입력 이미지를 전달했는지 자동 감지하여 텍스트-이미지와 이미지 편집 중 무엇을 사용할지 결정합니다:텍스트-이미지
프롬프트만 입력하면 → 14가지 종횡비와 512/1K/2K/4K 해상도를 갖춘 완전히 새로운 이미지를 생성합니다.
이미지 편집
이미지 1장 + 지시문 → 부분 편집, 스타일 변경, 배경 교체 등.
다중 이미지 합성
여러 이미지 + 지시문 1개 → 합성, 비교, 의상 교체 등.
1:4 / 4:1 / 1:8 / 8:1)과 전용 512px 저해상도 티어를 추가로 제공하며, 호출당 이미지 1장 기준 $0.055에 불과합니다(token 기준으로는 이미지당 약 $0.025까지 가능) — 대량 사용에 더 적합합니다.
어떤 에이전트가 사용할 수 있는지
스킬은 본질적으로 폴더 하나에 불과합니다. 즉, 에이전트가 읽을 지침(
SKILL.md)과 작업을 수행하는 스크립트로 이루어진 집합입니다. 따라서 로컬 파일을 읽고 셸 명령을 실행할 수 있는 모든 코딩 에이전트가 이를 사용할 수 있습니다 — 예를 들어 Codex, OpenClaw, hermes-agent, Claude Code 등이 있습니다.유일한 요구 사항은 에이전트를 실행하는 머신(사용자 컴퓨터 또는 서버)에 Python 3가 설치되어 있고 네트워크 액세스가 있어야 한다는 점입니다(스크립트가 api.apiyi.com을 직접 호출합니다). 그것이 전부입니다 — 특정 에이전트에 종속되지 않습니다.3단계로 설정하기
① 폴더를 만들고 파일을 붙여넣기
다음 두 파일이 들어 있는 스킬 폴더를 만드십시오(전체 내용은 다음 두 섹션에 있습니다):② 같은 폴더에 키 넣기
api.apiyi.com 콘솔에서 생성한 APIYI API Key를 nano-banana-2/.env에 적으십시오:
.env에서 키를 자동으로 읽어옵니다 — 추가 설정이나 환경 변수는 필요하지 않습니다.
③ 에이전트에게 전달하기
- 스킬을 자동으로 검색하는 에이전트(예: Claude Code)의 경우: 전체
nano-banana-2/폴더를 해당 스킬 디렉터리에 넣으십시오 — 개인~/.claude/skills/또는 프로젝트 수준.claude/skills/(저장소를 통해 공유됨)입니다. - 다른 에이전트의 경우: 각자 정한 스킬/플러그인 규칙에 맞게 배치하십시오. 또는 가장 간단한 방법으로는 에이전트에게 “이 폴더의 SKILL.md를 읽고 따르십시오”라고 지시하면 됩니다.
SKILL.md
nano-banana-2/SKILL.md를 아래 전체 내용으로 생성합니다(description에는 “무엇을 하는지 + 언제 사용하는지”가 적혀 있으며, 이는 Agent가 자동으로 트리거하는 데 사용됩니다):
scripts/nano_banana_2.py
APIYI 텍스트-이미지 / 이미지 편집 참고 페이지의 검증된 작동 코드와 동일한 Gemini 네이티브 형식으로nano-banana-2/scripts/nano_banana_2.py를 생성합니다. 순수 Python 표준 라이브러리만 사용하며 — pip install는 필요하지 않습니다:
왜 한 문장만으로 이미지가 생성되는가
많은 분이 이렇게 궁금해합니다. 명령어를 한 번도 입력하지 않았는데, 어떻게 “고양이를 그려라”가 이미지를 생성했을까요? 작동 방식은 다음과 같습니다. 시작 시 에이전트는 각 스킬의description에서 SKILL.md를 먼저 읽습니다(“이 스킬이 무엇을 하며 언제 사용해야 하는지”를 설명하는 매우 짧은 메타데이터입니다). 요청이 해당 시나리오와 일치하면(예: “이미지를 그리기 / 생성하기 / 렌더링하기”, “이 이미지를 …로 편집하기”), 에이전트는 자동으로 그 스킬을 호출하기로 결정하고, 전체 SKILL.md를 읽은 뒤 스크립트를 실행합니다. 이 모든 과정은 사용자가 어떤 명령어도 기억하지 않아도 자동으로 이루어집니다.
따라서:
- 잘 작성된
description= 더 정확한 자동 트리거링입니다. 이 스킬의 설명에는 이미 “이미지 생성 / 그리기 / 편집 / 합성” 같은 표현이 포함되어 있습니다. - 에이전트가 추측하지 않게 하고 완전한 제어를 원하신다면, 아래의 명시적 호출을 사용하십시오.
사용 방법
자연어(암시적 트리거)
설치가 끝나면 에이전트와 그냥 대화하면 됩니다:명시적 호출(더 많은 제어)
에이전트가 스스로 결정하게 하고 싶지 않을 때는, 두 가지 명시적 방법이 있습니다:-
슬래시 명령을 지원하는 에이전트(예: Claude Code):
-
모든 에이전트 / 그냥 스크립트를 실행하라고 지시(가장 범용적):
생성된 이미지의 저장 위치
-o가 디렉터리 경로가 없는 파일 이름(예:-o dog.png)인 경우, 이미지들은 모두 프로젝트 루트의nano-banana-output/폴더에 자동으로 저장됩니다. 따라서 프로젝트 안에서 바로 찾을 수 있습니다.- “프로젝트 루트” = 스크립트 자체의 위치에서 위로 올라가며 찾은
.git또는.claude를 포함하는 첫 번째 디렉터리입니다. 즉, 에이전트가 어느 디렉터리에서 실행되든 이미지가 프로젝트 안에 저장되며, 찾을 수 없는 임시 디렉터리에 저장되지 않습니다. - 스크립트는 이미지마다 전체 절대 경로를 하나씩 출력합니다. 예:
Image saved to /Users/you/project/nano-banana-output/dog.png. - 기본값은 이미지 1장만 생성합니다.
-n 3는 한 번에 3장을 생성하며(최대 5장, 그보다 많으면 5장으로 제한됨),-1,-2,-3접미사가 자동으로 추가됩니다. -o가 디렉터리가 있는 경로(예:-o images/dog.png또는 절대 경로)인 경우, 해당 정확한 경로에 저장되며(상대 경로는 현재 작업 디렉터리를 기준으로 합니다)nano-banana-output/에는 저장되지 않습니다.- 이미지 편집도 같은 방식으로 동작합니다. 출력은 새 파일이며 원본을 덮어쓰지 않습니다.
Nano Banana 2는 엄격한 콘텐츠 안전 제어를 갖추고 있습니다. 스크립트가
finishReason를 STOP가 아닌 값으로 보고하거나 거절 텍스트를 반환하면, 콘텐츠를 그에 맞게 조정하고 동일한 위반 prompt를 반복해서 재시도하지 마십시오.