Skip to main content
本頁提供一個開箱即用的 Agent 技能(Skill):把它放進你正在用的編碼 Agent,就能用自然語言(或顯式命令)直接呼叫 API易 平臺的 Nano Banana 2 Litegemini-3.1-flash-lite-image)完成生圖與改圖。整套東西就兩個檔案,複製即用。
如果你需要更高畫質或 2K/4K,見 Nano Banana 2 Agent 技能(最高 4K)或 Nano Banana Pro Agent 技能(極致畫質)。本頁是 Lite(最快最省,專注 1K,按次 $0.025/次)。

這個技能能做什麼

一個合併技能,指令碼會根據是否傳入圖片自動判斷是「文生圖」還是「圖片編輯」:

文生圖

只給提示詞 → 生成全新圖片,支援 14 種寬高比,1K 畫布,約 4 秒出圖。

圖片編輯

傳入一張圖 + 指令 → 局部編輯、風格遷移、背景替換等。

多圖合成

傳入多張圖 + 一條指令 → 多圖合成、對比、換裝等高階玩法。
Nano Banana 2 Lite 主打速度與成本:約 4 秒出圖、比 Nano Banana 2 快約 2.7 倍,按量實測約 $0.018/次(官網 4 折費率)、按次 $0.025/張,最適合高併發、快速迭代、走量場景。

能用在哪些 Agent

一個 Skill 本質上就是一個資料夾:一份寫給 Agent 看的說明(SKILL.md)+ 一個幹活的指令碼。所以凡是能讀取本地檔案、執行命令列的編碼 Agent 都能用上——比如 Codex、OpenClaw、hermes-agent、Claude Code 等。唯一要求:跑 Agent 的那臺機器(你的電腦或伺服器)裝了 Python 3 並且能聯網(指令碼要直連 api.apiyi.com)。僅此而已,不挑具體哪家 Agent。

三步裝好

① 建目錄、貼檔案

新建一個技能資料夾,放入下面兩個檔案(完整內容見後兩節):

② 同目錄寫 Key

nano-banana-lite/.env 裡寫上你的 API易 API Key(在 api.apiyi.com 控制台建立):
指令碼會自動從這個 .env 讀取 Key,無需任何額外配置或環境變數
.env 裡是你的金鑰。如果這個技能要隨專案倉庫共享,務必把 .env 加進 .gitignore,不要提交到 git

③ 交給 Agent

  • 支援技能自動發現的 Agent(如 Claude Code):把整個 nano-banana-lite/ 目錄放進它的技能目錄——個人級 ~/.claude/skills/,或專案級 .claude/skills/(隨倉庫共享)。
  • 其他 Agent:按它各自的技能/外掛約定放置;或者最簡單——直接讓 Agent「讀一下這個資料夾裡的 SKILL.md,並照著執行」 即可。
裝好後就能用了,跳到 怎麼用 看示例。

SKILL.md

新建 nano-banana-lite/SKILL.md,完整內容如下(description 寫清「做什麼 + 何時用」,Agent 會據此自動觸發):
name 必須是小寫字母 + 連字元,且不能含 claude / anthropic 等保留詞。在支援斜槓命令的 Agent 裡,目錄名就是命令名——叫 nano-banana-lite/nano-banana-lite${CLAUDE_SKILL_DIR} 是 Claude Code 提供的技能目錄變數;其他 Agent 直接用指令碼的實際路徑即可。

scripts/nano_banana_lite.py

新建 nano-banana-lite/scripts/nano_banana_lite.py,使用 Gemini 原生格式(與本站文生圖 / 圖片編輯介面程式碼一致、已驗證可跑)。純 Python 標準庫,無需 pip install 任何東西
模型名預設 gemini-3.1-flash-lite-image。Lite 專注 1K 畫布,--size 保持 1K 即可;如需 2K/4K 或更強畫質,換用 Nano Banana 2 / Pro 的技能(設環境變數 APIYI_IMAGE_MODEL 也可切換模型)。

為什麼一句話就能出圖

很多人好奇:我又沒敲命令,怎麼說句”畫只貓”它就出圖了? 原理是這樣:Agent 啟動時會先讀取每個技能 SKILL.md 裡的 description(一段很短的後設資料,說明「這個技能做什麼、什麼時候該用」)。當你說出的需求匹配上這段描述的場景(比如”畫/生成/渲染一張圖""把這張圖改成…”),Agent 就自動決定呼叫這個技能,去讀完整的 SKILL.md 並執行指令碼——整個過程你不用記任何命令。 所以:
  • 寫得好的 description = 更準的自動觸發。本技能的描述已覆蓋”生成/繪製/編輯/合成圖片”等說法。
  • 不想靠 Agent 猜、想要百分百可控時,用下面的顯性呼叫

怎麼用

自然語言(隱式觸發)

裝好後直接對 Agent 說話即可:

顯性呼叫(更可控)

不想讓 Agent 自己判斷時,兩種顯式方式:
  • 支援斜槓命令的 Agent(如 Claude Code):
  • 任意 Agent / 直接命令它跑指令碼(最通用):
怎麼控制比例:用 --aspect 選寬高比(14 選 1,含 1:4 / 4:1 / 1:8 / 8:1 超長超寬)。Lite 專注 1K 畫布,無需指定解析度。直接說”豎屏 9:16""來個超寬橫幅”,Agent 也會自動帶上寬高比引數。

生成的圖片在哪裡

  • -o 只傳檔名(如 -o dog.png)時,圖片統一存到專案根目錄下的 nano-banana-output/ 資料夾(指令碼自動建立),所以你在專案裡的這個資料夾就能直接找到。
  • 「專案根目錄」= 指令碼從自身位置向上找到的第一個含 .git.claude 的目錄——不管 Agent 在哪個目錄執行,圖都落在專案裡,不會跑進臨時目錄害你找不到。
  • 指令碼會為每張圖列印一行完整絕對路徑,例如 圖片已儲存至 /Users/you/project/nano-banana-output/dog.png
  • 預設只出 1 張-n 3 一次出 3 張(最多 5,超過自動截到 5),檔名自動加 -1-2-3 字尾。
  • 帶目錄的路徑(如 -o images/dog.png 或絕對路徑)時,按你給的路徑存(相對路徑相對當前工作目錄),不進 nano-banana-output/
  • 圖片編輯同理:輸出是新檔案,不會覆蓋你的原圖
Nano Banana 2 Lite 有嚴格的內容安全管控。若指令碼提示 finishReasonSTOP 或返回的是拒絕說明文本,請按提示調整內容,不要對同一違規提示詞反覆重試。

相關文件