이 페이지에서는 즉시 사용 가능한 Agent Skill을 제공합니다. 이미 사용 중인 코딩 Agent에 추가한 뒤, 자연어(또는 명시적 명령어)로 APIYI 플랫폼의 Nano Banana 2.1(
gemini-nano-banana-2.1)을 호출하여 이미지 생성 및 편집을 수행할 수 있습니다. 전체 구성은 두 개의 파일로만 이루어져 있어 복사 후 바로 사용할 수 있습니다.스킬 기능 안내
단일 통합 스킬입니다. 스크립트가 입력 이미지를 전달했는지 여부를 자동으로 감지하여 텍스트 투 이미지(text-to-image)와 이미지 편집 중 하나를 결정합니다.텍스트 투 이미지(Text to image)
prompt만 입력 → 14가지 화면비와 1K/2K/4K 해상도를 지원하는 완전히 새로운 이미지를 생성합니다.
이미지 편집
단일 이미지 + 지시 사항 입력 → 부분 수정, 스타일 변경, 배경 교체 등을 수행합니다.
다중 이미지 합성
여러 이미지 + 단일 지시 사항 입력 → 합성, 비교, 의상 교체 등을 수행합니다.
1:4 / 4:1 / 1:8 / 8:1)를 추가로 지원하며, 호출당 단 $0.05/이미지(1K / 2K / 4K 동일 가격)의 비용으로 대량 작업에 훨씬 더 적합합니다. 단, 512px는 지원하지 않으므로, 썸네일 등급의 크기가 필요한 경우에는 Nano Banana 2를 사용하십시오.
어떤 Agent가 사용할 수 있습니까
Skill은 본질적으로 하나의 폴더일 뿐입니다. 즉, Agent가 읽을 지침 세트(
SKILL.md)와 작업을 수행하는 스크립트의 조합입니다. 따라서 로컬 파일을 읽고 셸 명령을 실행할 수 있는 모든 코딩 Agent에서 이를 사용할 수 있습니다. 예를 들어 Codex, OpenClaw, hermes-agent, Claude Code 등이 있습니다.유일한 요구 사항은 Agent를 실행하는 머신(컴퓨터 또는 서버)에 Python 3가 설치되어 있고 네트워크 접근이 가능해야 한다는 점뿐입니다(스크립트가 api.apiyi.com을 직접 호출합니다). 이것이 전부이며, 특정 Agent에 종속되지 않습니다.3단계로 설정하기
① 폴더 생성 및 파일 붙여넣기
다음 두 파일이 포함된 스킬 폴더를 생성합니다(전체 내용은 다음 두 섹션 참조):② 동일한 폴더에 키 저장하기
APIYI API Key(api.apiyi.com 콘솔에서 생성)를 nano-banana-2-1/.env에 입력합니다:
.env에서 자동으로 키를 읽어오므로 추가 설정이나 환경 변수가 필요하지 않습니다.
③ 에이전트에 전달하기
- 스킬 자동 감지를 지원하는 에이전트(예: Claude Code):
nano-banana-2-1/폴더 전체를 해당 에이전트의 스킬 디렉터리에 넣습니다. 개인용은~/.claude/skills/, 프로젝트 수준(저장소를 통해 공유)은.claude/skills/입니다. - 기타 에이전트: 자체 스킬/플러그인 규칙에 따라 배치하거나, 가장 간단하게는 에이전트에게 “이 폴더의 SKILL.md를 읽고 지침을 따르십시오”라고 지시하면 됩니다.
SKILL.md
아래 전체 내용으로nano-banana-2-1/SKILL.md을 생성합니다(description에는 에이전트가 자동 트리거에 사용하는 “수행하는 작업 + 사용 시점”이 명시되어 있습니다).
scripts/nano_banana_2_1.py
Gemini 네이티브 형식을 사용하여nano-banana-2-1/scripts/nano_banana_2_1.py을(를) 생성합니다 (APIYI 텍스트-이미지 변환 / 이미지 편집 레퍼런스 페이지의 검증된 정상 작동 코드와 동일합니다). 순수 Python 표준 라이브러리 — pip install 설치 불필요:
한 문장으로 이미지가 생성되는 이유
명령어를 직접 입력한 적이 없는데 어떻게 “고양이 그려줘”라는 문장만으로 이미지가 생성되는지 궁금해하는 경우가 많습니다. 작동 방식은 다음과 같습니다. 시작 시 에이전트는description을(를) 각 스킬의 SKILL.md에서 먼저 읽습니다(이는 “이 스킬이 어떤 역할을 하며 언제 사용해야 하는지”를 설명하는 매우 짧은 메타데이터입니다). 사용자의 요청이 해당 시나리오와 일치하면(예: “이미지 그리기 / 생성 / 렌더링”, “이 이미지를 …로 편집”), 에이전트는 자동으로 스킬 호출을 결정하고 전체 SKILL.md을(를) 읽은 후 스크립트를 실행합니다. 즉, 사용자가 어떠한 명령어도 외우거나 입력할 필요가 없습니다.
따라서:
- 잘 작성된
description= 더욱 정확한 자동 트리거. 이 스킬의 설명에는 이미 “이미지 생성 / 그리기 / 편집 / 합성”과 같은 표현이 포함되어 있습니다. - 에이전트의 추측에 맡기지 않고 완전한 제어를 원하신다면, 아래의 명시적 호출 방식을 사용하십시오.
사용 방법
자연어 (암시적 트리거)
설치가 완료되면 에이전트와 대화하기만 하면 됩니다:명시적 호출 (더 세밀한 제어)
에이전트가 스스로 결정하는 것을 원하지 않는 경우, 두 가지 명시적 방법이 있습니다:-
슬래시 명령어를 지원하는 에이전트 (예: Claude Code):
-
모든 에이전트 / 스크립트 직접 실행 지시 (가장 범용적):
생성된 이미지가 저장되는 위치
-o이(가) 단순 파일 이름(예:-o dog.png)인 경우, 이미지는 모두 프로젝트 루트의nano-banana-2-1-output/폴더(자동 생성됨)에 저장되므로 프로젝트 내에서 바로 확인할 수 있습니다.- “프로젝트 루트” = 스크립트 자체 위치에서 상위 디렉터리로 탐색하여
.git또는.claude을(를) 포함하는 첫 번째 디렉터리를 의미합니다. 따라서 에이전트가 어느 디렉터리에서 실행되든 이미지는 프로젝트 내에 저장되며, 찾을 수 없는 임시 디렉터리로 들어가지 않습니다. - 스크립트는 이미지마다 전체 절대 경로를 하나씩 출력합니다(예:
Image saved to /Users/you/project/nano-banana-2-1-output/dog.png). - 기본적으로 단 1개의 이미지만 생성합니다.
-n 3은(는) 한 번에 3개를 생성하며(최대 5개, 그 이상은 5개로 제한됨), 자동으로-1,-2,-3접미사가 추가됩니다. -o이(가) 디렉터리가 포함된 경로(예:-o images/dog.png또는 절대 경로)인 경우, 해당 정확한 경로에 저장되며(상대 경로는 현재 작업 디렉터리 기준)nano-banana-2-1-output/에는 들어가지 않습니다.- 이미지 편집도 동일하게 작동합니다. 출력은 새로운 파일이며 원본을 덮어쓰지 않습니다.
Nano Banana 2.1에는 엄격한 콘텐츠 안전 제어가 적용되어 있습니다. 스크립트가
STOP 이외의 finishReason을(를) 보고하거나 거부 텍스트를 반환하는 경우, 콘텐츠를 적절히 조정하고 위반되는 동일한 prompt를 반복해서 재시도하지 마십시오.