Skip to main content
이 페이지에서는 즉시 사용 가능한 Agent Skill을 제공합니다. 이미 사용 중인 코딩 Agent에 추가한 뒤, 자연어(또는 명시적 명령어)로 APIYI 플랫폼의 Nano Banana 2.1(gemini-nano-banana-2.1)을 호출하여 이미지 생성 및 편집을 수행할 수 있습니다. 전체 구성은 두 개의 파일로만 이루어져 있어 복사 후 바로 사용할 수 있습니다.
최상급 품질의 Pro 스킬(gemini-3-pro-image)을 원하신다면 Nano Banana Pro Agent Skill을 참고하십시오. 이 페이지에서 다루는 모델은 Nano Banana 2.1(더 뛰어난 품질과 텍스트 렌더링을 제공하는 Nano Banana 2의 업그레이드 버전)입니다. 이전 버전을 계속 사용 중이신가요? Nano Banana 2 Agent Skill을 참고하십시오.

스킬 기능 안내

단일 통합 스킬입니다. 스크립트가 입력 이미지를 전달했는지 여부를 자동으로 감지하여 텍스트 투 이미지(text-to-image)와 이미지 편집 중 하나를 결정합니다.

텍스트 투 이미지(Text to image)

prompt만 입력 → 14가지 화면비와 1K/2K/4K 해상도를 지원하는 완전히 새로운 이미지를 생성합니다.

이미지 편집

단일 이미지 + 지시 사항 입력 → 부분 수정, 스타일 변경, 배경 교체 등을 수행합니다.

다중 이미지 합성

여러 이미지 + 단일 지시 사항 입력 → 합성, 비교, 의상 교체 등을 수행합니다.
Pro 버전과 비교하여, Nano Banana 2.1은 네 가지 초세로/초가로 화면비(1:4 / 4:1 / 1:8 / 8:1)를 추가로 지원하며, 호출당 단 $0.05/이미지(1K / 2K / 4K 동일 가격)의 비용으로 대량 작업에 훨씬 더 적합합니다. 단, 512px는 지원하지 않으므로, 썸네일 등급의 크기가 필요한 경우에는 Nano Banana 2를 사용하십시오.

어떤 Agent가 사용할 수 있습니까

Skill은 본질적으로 하나의 폴더일 뿐입니다. 즉, Agent가 읽을 지침 세트(SKILL.md)와 작업을 수행하는 스크립트의 조합입니다. 따라서 로컬 파일을 읽고 셸 명령을 실행할 수 있는 모든 코딩 Agent에서 이를 사용할 수 있습니다. 예를 들어 Codex, OpenClaw, hermes-agent, Claude Code 등이 있습니다.유일한 요구 사항은 Agent를 실행하는 머신(컴퓨터 또는 서버)에 Python 3가 설치되어 있고 네트워크 접근이 가능해야 한다는 점뿐입니다(스크립트가 api.apiyi.com을 직접 호출합니다). 이것이 전부이며, 특정 Agent에 종속되지 않습니다.

3단계로 설정하기

① 폴더 생성 및 파일 붙여넣기

다음 두 파일이 포함된 스킬 폴더를 생성합니다(전체 내용은 다음 두 섹션 참조):

② 동일한 폴더에 키 저장하기

APIYI API Key(api.apiyi.com 콘솔에서 생성)를 nano-banana-2-1/.env에 입력합니다:
스크립트가 이 .env에서 자동으로 키를 읽어오므로 추가 설정이나 환경 변수가 필요하지 않습니다.
.env에는 비밀 키가 저장됩니다. 프로젝트 저장소를 통해 이 스킬을 공유하는 경우, 반드시 .env을 .gitignore에 추가하고 git에 절대 커밋하지 마십시오.

③ 에이전트에 전달하기

  • 스킬 자동 감지를 지원하는 에이전트(예: Claude Code): nano-banana-2-1/ 폴더 전체를 해당 에이전트의 스킬 디렉터리에 넣습니다. 개인용은 ~/.claude/skills/, 프로젝트 수준(저장소를 통해 공유)은 .claude/skills/입니다.
  • 기타 에이전트: 자체 스킬/플러그인 규칙에 따라 배치하거나, 가장 간단하게는 에이전트에게 “이 폴더의 SKILL.md를 읽고 지침을 따르십시오”라고 지시하면 됩니다.
설치가 완료되면 모든 준비가 끝납니다. 예시는 사용 방법을 확인하십시오.

SKILL.md

아래 전체 내용으로 nano-banana-2-1/SKILL.md을 생성합니다(description에는 에이전트가 자동 트리거에 사용하는 “수행하는 작업 + 사용 시점”이 명시되어 있습니다).
name은 영문 소문자와 하이픈(-)이어야 하며 claude / anthropic와 같은 예약어를 포함해서는 안 됩니다. 슬래시 명령어를 지원하는 에이전트에서는 디렉터리 이름이 명령어가 되며, nano-banana-2-1는 /nano-banana-2가 됩니다. ${CLAUDE_SKILL_DIR}는 Claude Code에서 제공하는 스킬 디렉터리 변수이며, 다른 에이전트에서는 스크립트의 실제 경로를 사용하시면 됩니다.

scripts/nano_banana_2_1.py

Gemini 네이티브 형식을 사용하여 nano-banana-2-1/scripts/nano_banana_2_1.py을(를) 생성합니다 (APIYI 텍스트-이미지 변환 / 이미지 편집 레퍼런스 페이지의 검증된 정상 작동 코드와 동일합니다). 순수 Python 표준 라이브러리 — pip install 설치 불필요:
기본 모델 이름은 gemini-nano-banana-2.1입니다. 이전 버전으로 임시 전환하려면 APIYI_IMAGE_MODEL=gemini-3.1-flash-image(으)로 설정하십시오 (이전 버전은 --size 512도 지원합니다).

한 문장으로 이미지가 생성되는 이유

명령어를 직접 입력한 적이 없는데 어떻게 “고양이 그려줘”라는 문장만으로 이미지가 생성되는지 궁금해하는 경우가 많습니다. 작동 방식은 다음과 같습니다. 시작 시 에이전트는 description을(를) 각 스킬의 SKILL.md에서 먼저 읽습니다(이는 “이 스킬이 어떤 역할을 하며 언제 사용해야 하는지”를 설명하는 매우 짧은 메타데이터입니다). 사용자의 요청이 해당 시나리오와 일치하면(예: “이미지 그리기 / 생성 / 렌더링”, “이 이미지를 …로 편집”), 에이전트는 자동으로 스킬 호출을 결정하고 전체 SKILL.md을(를) 읽은 후 스크립트를 실행합니다. 즉, 사용자가 어떠한 명령어도 외우거나 입력할 필요가 없습니다. 따라서:
  • 잘 작성된 description = 더욱 정확한 자동 트리거. 이 스킬의 설명에는 이미 “이미지 생성 / 그리기 / 편집 / 합성”과 같은 표현이 포함되어 있습니다.
  • 에이전트의 추측에 맡기지 않고 완전한 제어를 원하신다면, 아래의 명시적 호출 방식을 사용하십시오.

사용 방법

자연어 (암시적 트리거)

설치가 완료되면 에이전트와 대화하기만 하면 됩니다:

명시적 호출 (더 세밀한 제어)

에이전트가 스스로 결정하는 것을 원하지 않는 경우, 두 가지 명시적 방법이 있습니다:
  • 슬래시 명령어를 지원하는 에이전트 (예: Claude Code):
  • 모든 에이전트 / 스크립트 직접 실행 지시 (가장 범용적):
종횡비 및 선명도 제어 방법: 종횡비에는 --aspect를 사용하고(Pro에는 없는 1:4 / 4:1 / 1:8 / 8:1 초세로형/초가로형 옵션을 포함한 14가지 옵션 제공), 해상도에는 --size를 사용합니다(1K / 2K / 4K 지원, 512은 지원되지 않음). “세로형 9:16”, “4K로 렌더링해줘”, “초광폭 배너 만들어줘”와 같이 말하기만 하면 에이전트가 이러한 플래그를 자동으로 추가합니다.

생성된 이미지가 저장되는 위치

  • -o이(가) 단순 파일 이름(예: -o dog.png)인 경우, 이미지는 모두 프로젝트 루트의 nano-banana-2-1-output/ 폴더(자동 생성됨)에 저장되므로 프로젝트 내에서 바로 확인할 수 있습니다.
  • “프로젝트 루트” = 스크립트 자체 위치에서 상위 디렉터리로 탐색하여 .git 또는 .claude을(를) 포함하는 첫 번째 디렉터리를 의미합니다. 따라서 에이전트가 어느 디렉터리에서 실행되든 이미지는 프로젝트 내에 저장되며, 찾을 수 없는 임시 디렉터리로 들어가지 않습니다.
  • 스크립트는 이미지마다 전체 절대 경로를 하나씩 출력합니다(예: Image saved to /Users/you/project/nano-banana-2-1-output/dog.png).
  • 기본적으로 단 1개의 이미지만 생성합니다. -n 3은(는) 한 번에 3개를 생성하며(최대 5개, 그 이상은 5개로 제한됨), 자동으로 -1, -2, -3 접미사가 추가됩니다.
  • -o이(가) 디렉터리가 포함된 경로(예: -o images/dog.png 또는 절대 경로)인 경우, 해당 정확한 경로에 저장되며(상대 경로는 현재 작업 디렉터리 기준) nano-banana-2-1-output/에는 들어가지 않습니다.
  • 이미지 편집도 동일하게 작동합니다. 출력은 새로운 파일이며 원본을 덮어쓰지 않습니다.
Nano Banana 2.1에는 엄격한 콘텐츠 안전 제어가 적용되어 있습니다. 스크립트가 STOP 이외의 finishReason을(를) 보고하거나 거부 텍스트를 반환하는 경우, 콘텐츠를 적절히 조정하고 위반되는 동일한 prompt를 반복해서 재시도하지 마십시오.

관련 문서