Image Editing: Edit an existing image with text instructions
curl --request POST \
--url https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"contents": [
{
"parts": [
{
"text": "Combine the people from these two images into one office scene, making funny faces"
},
{
"inlineData": {
"mimeType": "image/png",
"data": "<BASE64_DATA_IMG_1>"
}
},
{
"inlineData": {
"mimeType": "image/png",
"data": "<BASE64_DATA_IMG_2>"
}
}
]
}
],
"generationConfig": {
"responseModalities": [
"IMAGE"
],
"imageConfig": {
"aspectRatio": "16:9",
"imageSize": "2K"
}
}
}
'import requests
url = "https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent"
payload = {
"contents": [{ "parts": [{ "text": "Combine the people from these two images into one office scene, making funny faces" }, { "inlineData": {
"mimeType": "image/png",
"data": "<BASE64_DATA_IMG_1>"
} }, { "inlineData": {
"mimeType": "image/png",
"data": "<BASE64_DATA_IMG_2>"
} }] }],
"generationConfig": {
"responseModalities": ["IMAGE"],
"imageConfig": {
"aspectRatio": "16:9",
"imageSize": "2K"
}
}
}
headers = {
"Authorization": "Bearer <token>",
"Content-Type": "application/json"
}
response = requests.post(url, json=payload, headers=headers)
print(response.text)const options = {
method: 'POST',
headers: {Authorization: 'Bearer <token>', 'Content-Type': 'application/json'},
body: JSON.stringify({
contents: [
{
parts: [
{
text: 'Combine the people from these two images into one office scene, making funny faces'
},
{inlineData: {mimeType: 'image/png', data: '<BASE64_DATA_IMG_1>'}},
{inlineData: {mimeType: 'image/png', data: '<BASE64_DATA_IMG_2>'}}
]
}
],
generationConfig: {
responseModalities: ['IMAGE'],
imageConfig: {aspectRatio: '16:9', imageSize: '2K'}
}
})
};
fetch('https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));<?php
$curl = curl_init();
curl_setopt_array($curl, [
CURLOPT_URL => "https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => json_encode([
'contents' => [
[
'parts' => [
[
'text' => 'Combine the people from these two images into one office scene, making funny faces'
],
[
'inlineData' => [
'mimeType' => 'image/png',
'data' => '<BASE64_DATA_IMG_1>'
]
],
[
'inlineData' => [
'mimeType' => 'image/png',
'data' => '<BASE64_DATA_IMG_2>'
]
]
]
]
],
'generationConfig' => [
'responseModalities' => [
'IMAGE'
],
'imageConfig' => [
'aspectRatio' => '16:9',
'imageSize' => '2K'
]
]
]),
CURLOPT_HTTPHEADER => [
"Authorization: Bearer <token>",
"Content-Type: application/json"
],
]);
$response = curl_exec($curl);
$err = curl_error($curl);
curl_close($curl);
if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}package main
import (
"fmt"
"strings"
"net/http"
"io"
)
func main() {
url := "https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent"
payload := strings.NewReader("{\n \"contents\": [\n {\n \"parts\": [\n {\n \"text\": \"Combine the people from these two images into one office scene, making funny faces\"\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_1>\"\n }\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_2>\"\n }\n }\n ]\n }\n ],\n \"generationConfig\": {\n \"responseModalities\": [\n \"IMAGE\"\n ],\n \"imageConfig\": {\n \"aspectRatio\": \"16:9\",\n \"imageSize\": \"2K\"\n }\n }\n}")
req, _ := http.NewRequest("POST", url, payload)
req.Header.Add("Authorization", "Bearer <token>")
req.Header.Add("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)
defer res.Body.Close()
body, _ := io.ReadAll(res.Body)
fmt.Println(string(body))
}HttpResponse<String> response = Unirest.post("https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent")
.header("Authorization", "Bearer <token>")
.header("Content-Type", "application/json")
.body("{\n \"contents\": [\n {\n \"parts\": [\n {\n \"text\": \"Combine the people from these two images into one office scene, making funny faces\"\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_1>\"\n }\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_2>\"\n }\n }\n ]\n }\n ],\n \"generationConfig\": {\n \"responseModalities\": [\n \"IMAGE\"\n ],\n \"imageConfig\": {\n \"aspectRatio\": \"16:9\",\n \"imageSize\": \"2K\"\n }\n }\n}")
.asString();require 'uri'
require 'net/http'
url = URI("https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent")
http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true
request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer <token>'
request["Content-Type"] = 'application/json'
request.body = "{\n \"contents\": [\n {\n \"parts\": [\n {\n \"text\": \"Combine the people from these two images into one office scene, making funny faces\"\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_1>\"\n }\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_2>\"\n }\n }\n ]\n }\n ],\n \"generationConfig\": {\n \"responseModalities\": [\n \"IMAGE\"\n ],\n \"imageConfig\": {\n \"aspectRatio\": \"16:9\",\n \"imageSize\": \"2K\"\n }\n }\n}"
response = http.request(request)
puts response.read_body{
"candidates": [
{
"content": {
"parts": [
{
"inlineData": {
"mimeType": "image/png",
"data": "<string>"
}
}
]
},
"finishReason": "STOP"
}
],
"usageMetadata": {
"promptTokenCount": 10,
"candidatesTokenCount": 258
}
}Nano Banana 2.1画像生成
画像編集 API リファレンス
Nano Banana 2.1 画像編集 API リファレンスとインタラクティブなプレイグラウンド — 画像と指示を指定して編集結果を生成します
POST
/
v1beta
/
models
/
gemini-nano-banana-2.1:generateContent
Image Editing: Edit an existing image with text instructions
curl --request POST \
--url https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"contents": [
{
"parts": [
{
"text": "Combine the people from these two images into one office scene, making funny faces"
},
{
"inlineData": {
"mimeType": "image/png",
"data": "<BASE64_DATA_IMG_1>"
}
},
{
"inlineData": {
"mimeType": "image/png",
"data": "<BASE64_DATA_IMG_2>"
}
}
]
}
],
"generationConfig": {
"responseModalities": [
"IMAGE"
],
"imageConfig": {
"aspectRatio": "16:9",
"imageSize": "2K"
}
}
}
'import requests
url = "https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent"
payload = {
"contents": [{ "parts": [{ "text": "Combine the people from these two images into one office scene, making funny faces" }, { "inlineData": {
"mimeType": "image/png",
"data": "<BASE64_DATA_IMG_1>"
} }, { "inlineData": {
"mimeType": "image/png",
"data": "<BASE64_DATA_IMG_2>"
} }] }],
"generationConfig": {
"responseModalities": ["IMAGE"],
"imageConfig": {
"aspectRatio": "16:9",
"imageSize": "2K"
}
}
}
headers = {
"Authorization": "Bearer <token>",
"Content-Type": "application/json"
}
response = requests.post(url, json=payload, headers=headers)
print(response.text)const options = {
method: 'POST',
headers: {Authorization: 'Bearer <token>', 'Content-Type': 'application/json'},
body: JSON.stringify({
contents: [
{
parts: [
{
text: 'Combine the people from these two images into one office scene, making funny faces'
},
{inlineData: {mimeType: 'image/png', data: '<BASE64_DATA_IMG_1>'}},
{inlineData: {mimeType: 'image/png', data: '<BASE64_DATA_IMG_2>'}}
]
}
],
generationConfig: {
responseModalities: ['IMAGE'],
imageConfig: {aspectRatio: '16:9', imageSize: '2K'}
}
})
};
fetch('https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));<?php
$curl = curl_init();
curl_setopt_array($curl, [
CURLOPT_URL => "https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => json_encode([
'contents' => [
[
'parts' => [
[
'text' => 'Combine the people from these two images into one office scene, making funny faces'
],
[
'inlineData' => [
'mimeType' => 'image/png',
'data' => '<BASE64_DATA_IMG_1>'
]
],
[
'inlineData' => [
'mimeType' => 'image/png',
'data' => '<BASE64_DATA_IMG_2>'
]
]
]
]
],
'generationConfig' => [
'responseModalities' => [
'IMAGE'
],
'imageConfig' => [
'aspectRatio' => '16:9',
'imageSize' => '2K'
]
]
]),
CURLOPT_HTTPHEADER => [
"Authorization: Bearer <token>",
"Content-Type: application/json"
],
]);
$response = curl_exec($curl);
$err = curl_error($curl);
curl_close($curl);
if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}package main
import (
"fmt"
"strings"
"net/http"
"io"
)
func main() {
url := "https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent"
payload := strings.NewReader("{\n \"contents\": [\n {\n \"parts\": [\n {\n \"text\": \"Combine the people from these two images into one office scene, making funny faces\"\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_1>\"\n }\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_2>\"\n }\n }\n ]\n }\n ],\n \"generationConfig\": {\n \"responseModalities\": [\n \"IMAGE\"\n ],\n \"imageConfig\": {\n \"aspectRatio\": \"16:9\",\n \"imageSize\": \"2K\"\n }\n }\n}")
req, _ := http.NewRequest("POST", url, payload)
req.Header.Add("Authorization", "Bearer <token>")
req.Header.Add("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)
defer res.Body.Close()
body, _ := io.ReadAll(res.Body)
fmt.Println(string(body))
}HttpResponse<String> response = Unirest.post("https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent")
.header("Authorization", "Bearer <token>")
.header("Content-Type", "application/json")
.body("{\n \"contents\": [\n {\n \"parts\": [\n {\n \"text\": \"Combine the people from these two images into one office scene, making funny faces\"\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_1>\"\n }\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_2>\"\n }\n }\n ]\n }\n ],\n \"generationConfig\": {\n \"responseModalities\": [\n \"IMAGE\"\n ],\n \"imageConfig\": {\n \"aspectRatio\": \"16:9\",\n \"imageSize\": \"2K\"\n }\n }\n}")
.asString();require 'uri'
require 'net/http'
url = URI("https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent")
http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true
request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer <token>'
request["Content-Type"] = 'application/json'
request.body = "{\n \"contents\": [\n {\n \"parts\": [\n {\n \"text\": \"Combine the people from these two images into one office scene, making funny faces\"\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_1>\"\n }\n },\n {\n \"inlineData\": {\n \"mimeType\": \"image/png\",\n \"data\": \"<BASE64_DATA_IMG_2>\"\n }\n }\n ]\n }\n ],\n \"generationConfig\": {\n \"responseModalities\": [\n \"IMAGE\"\n ],\n \"imageConfig\": {\n \"aspectRatio\": \"16:9\",\n \"imageSize\": \"2K\"\n }\n }\n}"
response = http.request(request)
puts response.read_body{
"candidates": [
{
"content": {
"parts": [
{
"inlineData": {
"mimeType": "image/png",
"data": "<string>"
}
}
]
},
"finishReason": "STOP"
}
],
"usageMetadata": {
"promptTokenCount": 10,
"candidatesTokenCount": 258
}
}右側のインタラクティブなPlaygroundでは、パラメータをドロップダウン形式で選択できます。AuthorizationフィールドにAPIキー(形式:
Bearer sk-xxx)を入力すると、ワンクリックでテストリクエストを送信できます。対象範囲: このページは画像編集専用です。編集の指示とともに、入力画像(base64エンコード済み)を提供する必要があります。テキストのみから新しい画像を生成する場合は、テキストから画像生成エンドポイントを使用してください。
🖥️ ブラウザPlaygroundの制限事項(重要)このエンドポイントは、レスポンスとしてbase64エンコードされた画像(
inlineData.data、通常は数MB)を返します。ブラウザのレンダリング制限により、レスポンス受信後に右側のPlaygroundに请求时发生错误: unable to complete requestと表示される場合がありますが、リクエスト自体は実際には成功しています。単にブラウザがこれほど長いbase64文字列を描画できないだけです。推奨ワークフロー(初心者向け):- 以下のPython / Node.js / cURLサンプルをコピーしてローカルで実行してください。コードがレスポンスを自動的に
base64.b64decodeし、画像をファイルに書き込みます。 - どうしてもブラウザ内のPlaygroundを使用する場合は、非常に小さい参照画像(50KB未満)を使用し、
imageSizeを最小レベル(1K)に設定してください。
⚠️ 誤った例(各パートに
parts 配列構造(重要 — 複数画像の編集時は必ずお読みください)各partは、textまたはinlineDataのいずれか1つである必要があり、両方を含めることはできません。これはGoogle公式のgemini-nano-banana-2.1仕様に準拠しています。正しい例: 1つのtextパート(指示) + N個のinlineDataパート(画像1枚につき1個):"contents": [{
"parts": [
{"text": "Combine the people from these two images into one office scene"},
{"inlineData": {"mimeType": "image/png", "data": "<BASE64_DATA_IMG_1>"}},
{"inlineData": {"mimeType": "image/png", "data": "<BASE64_DATA_IMG_2>"}}
]
}]
textとinlineDataの両方が含まれている — 予期しない動作を引き起こします):"contents": [{
"parts": [
{"inlineData": {...}, "text": "is this the prompt 1"},
{"inlineData": {...}, "text": "is this the prompt 2"}
]
}]
🖼️ 実行後、Playgroundの
inlineData.data フィールドについてこのエンドポイントは JSON 形式(マルチパートファイルアップロードではありません)を使用しているため、Playgroundでローカルファイルを直接選択することはできません。まず画像を Base64 文字列に変換し、それを data 入力欄に貼り付ける必要があります。ワンライナーコマンド: 変換してクリップボードにコピー:# macOS
base64 -i your-image.jpg | tr -d '\n' | pbcopy
# Linux
base64 -w0 your-image.jpg | xclip -selection clipboard
# Windows PowerShell
[Convert]::ToBase64String([IO.File]::ReadAllBytes("your-image.jpg")) | Set-Clipboard
data フィールドに Cmd+V / Ctrl+V で貼り付けるだけです。また、mimeType を一致する image/jpeg または image/png に設定することも忘れないでください。推奨事項: 長いbase64文字列によるブラウザの遅延を避けるため、テストには小さな画像(200KB未満)を使用してください。頻繁に画像編集テストを行う場合は、代わりに以下のコード例を使用してローカルで実行してください。コード例
Python
import requests
import base64
API_KEY = "sk-your-api-key"
# Read the image to edit
with open("input.jpg", "rb") as f:
image_b64 = base64.b64encode(f.read()).decode()
response = requests.post(
"https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent",
headers={"Authorization": f"Bearer {API_KEY}", "Content-Type": "application/json"},
json={
"contents": [{
"parts": [
{"text": "Please blur the background to highlight the person in the foreground"},
{"inlineData": {"mimeType": "image/jpeg", "data": image_b64}}
]
}],
"generationConfig": {
"responseModalities": ["IMAGE"],
"imageConfig": {"aspectRatio": "16:9", "imageSize": "2K"}
}
},
timeout=300
).json()
img_data = [p for p in response["candidates"][0]["content"]["parts"] if "inlineData" in p][-1]["inlineData"]["data"]
with open("edited.png", 'wb') as f:
f.write(base64.b64decode(img_data))
print("Edited image saved to edited.png")
Node.js
import fs from "fs";
const API_KEY = "sk-your-api-key";
const imageB64 = fs.readFileSync("input.jpg").toString("base64");
const response = await fetch(
"https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent",
{
method: "POST",
headers: {
"Authorization": `Bearer ${API_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
contents: [{
parts: [
{ text: "Please blur the background to highlight the person in the foreground" },
{ inlineData: { mimeType: "image/jpeg", data: imageB64 } }
]
}],
generationConfig: {
responseModalities: ["IMAGE"],
imageConfig: { aspectRatio: "16:9", imageSize: "2K" }
}
})
}
);
const data = await response.json();
const imgBase64 = data.candidates[0].content.parts.filter((p) => p.inlineData).at(-1).inlineData.data;
fs.writeFileSync("edited.png", Buffer.from(imgBase64, "base64"));
cURL
# Note: convert image to base64 first
# IMAGE_B64=$(base64 -i input.jpg | tr -d '\n')
curl -X POST "https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent" \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"contents": [{
"parts": [
{"text": "Please blur the background to highlight the person in the foreground"},
{"inlineData": {"mimeType": "image/jpeg", "data": "'"$IMAGE_B64"'"}}
]
}],
"generationConfig": {
"responseModalities": ["IMAGE"],
"imageConfig": {"aspectRatio": "16:9", "imageSize": "2K"}
}
}'
複数画像の編集
複数の入力画像を統合または比較する場合、単一のtext パート(指示内容)の後に複数の inlineData パート(画像ごとに1つ)を使用します。
Python(複数画像)
import requests
import base64
API_KEY = "sk-your-api-key"
def to_b64(path):
with open(path, "rb") as f:
return base64.b64encode(f.read()).decode()
# Prepare multiple images (2 here as an example)
images = ["person1.png", "person2.png"]
parts = [{"text": "Combine the people from these images into one office scene, making funny faces"}]
for path in images:
parts.append({"inlineData": {"mimeType": "image/png", "data": to_b64(path)}})
response = requests.post(
"https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent",
headers={"Authorization": f"Bearer {API_KEY}", "Content-Type": "application/json"},
json={
"contents": [{"parts": parts}],
"generationConfig": {
"responseModalities": ["TEXT", "IMAGE"],
"imageConfig": {"aspectRatio": "5:4", "imageSize": "2K"}
}
},
timeout=300
).json()
img_data = [p for p in response["candidates"][0]["content"]["parts"] if "inlineData" in p][-1]["inlineData"]["data"]
with open("merged.png", "wb") as f:
f.write(base64.b64decode(img_data))
cURL(複数画像、Google の公式フォーマットに準拠)
curl -X POST "https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent" \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"contents": [{
"parts": [
{"text": "An office group photo of these people, they are making funny faces."},
{"inlineData": {"mimeType": "image/png", "data": "<BASE64_DATA_IMG_1>"}},
{"inlineData": {"mimeType": "image/png", "data": "<BASE64_DATA_IMG_2>"}},
{"inlineData": {"mimeType": "image/png", "data": "<BASE64_DATA_IMG_3>"}}
]
}],
"generationConfig": {
"responseModalities": ["TEXT", "IMAGE"],
"imageConfig": {"aspectRatio": "5:4", "imageSize": "2K"}
}
}'
パラメータクイックリファレンス
| パラメータ | 型 | 必須 | 説明 |
|---|---|---|---|
contents[].parts | 配列 | 必須 | 1つのtextパート + N個のinlineDataパートで構成されます。各パートにはtextまたはinlineDataのいずれか一方のみを含める必要があり、両方を含めることはできません |
contents[].parts[].text | 文字列 | 必須 | 編集指示(最初のパートにのみ配置してください) |
contents[].parts[].inlineData.mimeType | 文字列 | 必須 | image/jpegまたはimage/png |
contents[].parts[].inlineData.data | 文字列 | 必須 | Base64エンコードされた画像(複数画像を編集する場合は、画像ごとに1つのinlineDataパートを繰り返します) |
generationConfig.responseModalities | 配列 | 必須 | 通常は["IMAGE"] |
generationConfig.imageConfig.aspectRatio | 文字列 | 任意 | 14種類の比率。省略された場合はモデルがコンテンツに基づいて選択するため、明示的に指定してください |
generationConfig.imageConfig.imageSize | 文字列 | 任意 | 1K / 2K / 4K(512は非サポート)、デフォルトは1K |
generationConfig.thinkingConfig.thinkingLevel | 文字列 | 任意 | minimal / medium / high、デフォルトはmedium |
generationConfig.thinkingConfig.includeThoughts | 真偽値 | 任意 | 思考プロセスのテキストを返します |
マルチターンの対話型編集
Nano Banana 2.1(gemini-nano-banana-2.1)は真の対話型マルチターン編集をサポートしています。contentsに各ターンで生成された画像を**role: "model" inlineDataとして追加し、次のユーザー指示を送信します。モデルは完全な会話履歴**に基づいて編集を行い、変更を累積します(例:最初にソファの色を変更し、次に小物を追加した場合でも、以前の変更は保持されます)。
これはリバース画像モデルとは異なります。ネイティブのGeminiフォーマットは、
modelロールの履歴ターンから画像を忠実に読み取ります。ターン間の一貫性と段階的な調整を行うには、以下の履歴バックフィルパターンを使用してください。import requests, base64
API_KEY = "sk-your-api-key"
URL = "https://api.apiyi.com/v1beta/models/gemini-nano-banana-2.1:generateContent"
H = {"Authorization": f"Bearer {API_KEY}", "Content-Type": "application/json"}
CFG = {"responseModalities": ["IMAGE"], "imageConfig": {"aspectRatio": "1:1", "imageSize": "2K"}}
contents = [] # keep one running conversation history
def turn(instruction, save_to):
contents.append({"role": "user", "parts": [{"text": instruction}]})
data = requests.post(URL, headers=H,
json={"contents": contents, "generationConfig": CFG}, timeout=300).json()
part = next(p for p in data["candidates"][0]["content"]["parts"] if "inlineData" in p)
contents.append({"role": "model", "parts": [part]}) # key: backfill the output image into history
with open(save_to, "wb") as f:
f.write(base64.b64decode(part["inlineData"]["data"]))
return part
turn("Generate an orange cat sitting on a blue sofa, simple line-art style", "step1.png")
turn("Make the sofa red; keep the cat and composition unchanged", "step2.png") # edits the previous image
turn("Put a small yellow hat on the cat; keep everything else the same", "step3.png") # accumulates; red sofa kept
既存の画像からマルチターンを開始する: 既存の写真を編集するには、最初のユーザーメッセージに
inlineData(ご自身の画像)と指示を含め、その後ターンごとにモデル出力をcontentsへバックフィルし続けます。2つのマルチターンスタイル:
- 履歴バックフィル(上記、推奨):
contentsでユーザーとモデルが交互に続く履歴を保持し、より優れた一貫性でターン間の変更を累積します。 - 再フィード(よりシンプル): 以前のコンテキストを引き継がずに、各ターンで1ステップの編集用に単一のユーザーメッセージ(
text+ 前の画像のinlineData)を送信します。
承認
API Key obtained from APIYI Console
ボディ
application/json
このページは役に立ちましたか?