Skip to main content
POST
Image editing: edit a reference image or fuse several
🔒 デフォルトでは未開放: Grok Imagine 2 は Default グループには含まれません。専用の Grok_imagine グループに属しており、呼び出す前にアクセスを申請する必要があります(このページのプレイグラウンドを含む)。アクセスがない場合、すべての呼び出しで 503 が返されます。このファミリーのコンテンツ安全性ポリシーはプラットフォーム上の他のモデルと大きく異なり、一部のカテゴリはフィルタリングされません。そのためコンプライアンスリスクを抑えるため、アクセスは選択的に付与しています。累計利用額が $1,000 以上の既存のお客様は、ユースケースをサポートに説明することで有効化できます。その他の方は、ユースケースと導入済みのコンテンツモデレーション管理策を記載して WeCom サポートから申請してください。完全な手順: Grok Imagine 2 概要 - グループ設定。
右側のインタラクティブなプレイグラウンドでは、ローカルファイルをアップロードできます。Authorization に API Key を入力し(形式: Bearer sk-xxx)、image ファイルを選択して、prompt と model を入力し、送信してください。
🔴 このエンドポイントでは multipart/form-data ファイルアップロードが必要です/v1/images/edits に JSON を送信すると、常に 400 が返されます:
特に xAI またはアップストリームベンダーのドキュメントから統合する場合は重要です: そのドキュメントではパブリックな画像 URL({"image": {"type": "image_url", "url": "..."}})を含む JSON ボディが説明されていますが、その形式は APIYI ゲートウェイでは機能しません。代わりにこのページに従ってください。利点として、ファイルアップロードでは画像ホスティングが不要です — ローカルファイルをそのまま送信するだけでよく、パブリック URL を準備するより簡単です。ファイルフィールド名は image または image[] でなければなりません。images / image_file では 415 が返されます。prompt は必須であり、省略すると 400 が返されます。
このページを使用する場面: 1 枚の参照画像の編集、または複数画像の融合。prompt のみで生成する場合は、テキストから画像へのエンドポイントを使用してください。
⚠️ 出力寸法は最初の参照画像に従い、変更できませんresolution と aspect_ratio はここでエラーなく受け入れられますが、効果はありません — 編集後の出力は常に最初の参照画像の寸法と一致します(1280x720 を入力すると 1280x720 が出力され、1024x1024 を入力すると 1024x1024 が出力されます)。これは融合にも同様に適用されます。4 枚の参照画像の順序を逆にすると、出力は 1280x720 から 1024x1024 に切り替わり、新しい最初の画像に従います。出力サイズを変更するには、アップロード前に最初の参照画像をクロップまたはリサイズしてください。
融合順序には意味があります: image[] は 1~4 枚の参照画像を受け入れます(測定された上限は 4 枚で、5 枚目は 400 を返します)。また、アップロード順序が prompt 内の「画像 1 / 画像 2 / 画像 3」の対象です。たとえば、「画像 1 の被写体を画像 2 のシーンに配置し、画像 2 のアートスタイルを維持する」と明示してください。2 / 3 / 4 枚の参照画像で測定した結果、画像を 1 枚追加するごとに対応する被写体が出力に追加され、それぞれの特徴が維持されました — 融合は実際に機能します。

コード例

Python (OpenAI SDK、単一画像)

Python (生のリクエスト、単一画像)

Python (マルチ画像融合、1-4ファイル)

cURL

Node.js (ネイティブ fetch + FormData)

ブラウザ JavaScript

パラメータリファレンス

このファミリーはマスクインペインティングをサポートしていません。変更の範囲を限定したい場合は、prompt でそれを正確に記述してください。たとえば「スカーフだけを赤に変更し、それ以外はすべてまったく同じに保つ」といった具合です。モデルはそのような制約に厳密に従います。

編集動作とプロンプトスタイル

編集エンドポイントは、入力画像のアートスタイル、構図、パレット、被写体のアイデンティティを保持し、prompt が指定した内容だけを変更します。安定した結果を得るには:
「他のすべては変更しないでください」と明示すること は、このモデルで最も効果的な手法です。融合の場合は、image[] のアップロード順に合わせて、必ず「image 1 / image 2」を参照してください。また、最も重要な被写体を最初に置いてください: 最初の画像は出力サイズを決めるだけでなく、テストでは順序を逆にすると副次的な被写体のアイデンティティが別の被写体に混ざってしまいました。

レスポンス形式

レスポンスフィールドの落とし穴
  • 各 data[] エントリには、response_format に応じて url または b64_json のどちらか一方のみが含まれます — 両方は含まれません。
  • revised_promptは返されません — 存在すると仮定しないでください。
  • b64_json は data:image/...;base64, 接頭辞のない生の base64 です — そのままデコードしてください。
  • created は常に 0 であり、タイムスタンプとして使用できません。
  • 出力サイズは 入力画像 によって決定されるため、リクエストパラメータから幅/高さを予測しないでください。
usageは照合に使用できません: prompt_tokens は常に 1000 x n であり、プレースホルダーです。編集料金は text-to-image と同じで、画像ごとの定額料金です。実際の請求額は APIYI コンソールの課金記録を参照してください。

承認

Authorization
string
header
必須

API Key created in the APIYI Console

ボディ

multipart/form-data
model
enum<string>
デフォルト:grok-imagine-image
必須

Model ID

利用可能なオプション:
grok-imagine-image,
grok-imagine-image-quality
prompt
string
必須

Editing instruction. State what to change and explicitly ask for everything else to stay put, e.g. Change the scarf color to bright RED. Keep everything else exactly the same.

例:

"Change the scarf color to bright RED. Keep everything else exactly the same."

image
file
必須

Reference image file. For multi-image fusion repeat the image[] field (1-4 files); upload order is what "image 1 / image 2 / image 3" refers to in the prompt, and the first file also determines output dimensions. Each added image contributes a subject in testing. Accepted formats: png / jpg / webp.

n
integer
デフォルト:1

Number of output images, 1-10. Independent of the number of reference images

必須範囲: 1 <= x <= 10
例:

1

response_format
enum<string>
デフォルト:url

Response format. url returns a direct link; b64_json returns raw base64 (no data: prefix)

利用可能なオプション:
url,
b64_json
例:

"url"

レスポンス

Image generated successfully

created
integer

Creation timestamp. Always 0 for this model — do not use it for timing

例:

0

data
object[]

Array of image results, length equals the requested n

usage
object

Placeholder values — do not use for billing reconciliation. prompt_tokens is always 1000 x n