Skip to main content

概要

apiyi-gpt-image-2-genapiyi-gpt-image-2-all-gen は、コミュニティユーザー wuchubuzai2018 が提供した 2 つのオープンソース AI Agent スキルです。これらを使うと、APIYI の 2 つの OpenAI GPT 画像モデルである、公式 gpt-image-2(きめ細かな制御、token ベース課金、4K)とリバース gpt-image-2-all(会話型、呼び出しごとの課金、ChatGPT との同等性)を、Codex CLI, OpenCode, Gemini CLI, GitHub Copilot, Cursor, Amp をはじめとする任意の Skills 対応ツールから、1 つの自然言語 prompt だけで直接呼び出せます。
プロジェクト情報
  • 🔗 ソース: github.com/wuchubuzai2018/expert-skills-hub
  • 📦 スキルID: apiyi-gpt-image-2-gen(公式)、apiyi-gpt-image-2-all-gen(リバース)
  • 👤 作者: wuchubuzai2018
  • ⭐ コミュニティによる貢献で、作者の Nano Banana Pro Image-Gen Skill と同じリポジトリを共有しています
どのスキルを選べばよいですか?
  • apiyi-gpt-image-2-gen(公式、推奨): 制御しやすい size / quality / output-format / compression、4K(3840×2160)、カスタムサイズ、セマンティック編集をサポートします。token ベース課金で、品質やサイズに明確な要件がある場合に最適です
  • apiyi-gpt-image-2-all-gen(リバース): 必要なのは prompt と、任意の response-format だけです。サイズ/比率は prompt 内で指定します。呼び出しごとの課金($0.03/call)で、ChatGPT の Web 体験と同等です。自然言語でそのまま出力したい場合、強いテキスト描画、反復編集に最適です
  • 並べて比較: 公式 vs リバースの比較

主な機能

一文での画像生成

AI コーディングアシスタント内で中国語または英語でそのまま記述すると、画像が返ってきます

デュアルモデル対応

公式 gpt-image-2 とリバース gpt-image-2-all の両方が利用可能です — シナリオに応じて選べます

4K + カスタムサイズ(公式)

公式 Skill は 1024²、1536×1024、2048²、3840×2160 のプリセットとカスタム寸法に対応しています

品質 / 形式制御(公式)

quality(low / medium / high / auto)+ 出力形式(png / jpeg / webp)+ 圧縮 0-100

参照画像は最大5枚

両方の Skill は、マルチ画像融合とスタイル転送のために、最大5枚の重ねた参照画像に対応しています

マルチツール対応

Codex CLI、OpenCode、Gemini CLI、GitHub Copilot、Cursor、Amp で動作します

Node.js + Python ランタイム

generate_image.jsgenerate_image.py の両方を同梱しています

手間いらずのセットアップ

APIYI_API_KEY を一度設定すれば、-k で一時的に上書きできます

対応APIYIモデル

クイックスタート: 3ステップ

1

ステップ1: APIYIキーを取得する

  1. APIYIコンソールにアクセスしてサインインする
  2. トークンの下で、新しいキーを生成します(sk-で始まります)
  3. 推奨: 使用上限付きの専用キーを作成します
新規ユーザーには無料トライアル残高が付与されます — 2つのGPT画像モデルを試すのに十分です。
2

ステップ2: スキルをインストールする — どちらか一方を選ぶか、両方をインストールします

公式 gpt-image-2(推奨):
リバース gpt-image-2-all:
Node.js が必要です。Python スクリプトはバックアップ実行環境として使えます。Node.js がインストールされていない場合は、nodejs.org から入手してください。
3

ステップ3: APIキーを設定する

環境変数を設定します(~/.zshrc / ~/.bashrc に永続化することを推奨します):
Windows PowerShell:
完了です!Skills対応のAIコーディングツールなら、自然言語でこの2つのスキルを起動できるようになりました。

コマンドラインパラメータ

apiyi-gpt-image-2-gen(公式)

対応アスペクト比: 1:1, 3:2, 2:3, 16:9, 9:16, および 3:1 以内の任意のカスタム比率。 カスタムサイズの制約: 各辺は 3840px 以下、両方の寸法は 16 で割り切れること、総ピクセル数は 655,360 から 8,294,400 の間であること。 通常のレイテンシ: 1 リクエストあたり 120〜150 秒(複雑な 4K シーンではさらに長くなります)。

apiyi-gpt-image-2-all-gen(逆)

reverse スキルは size / quality / aspect_ratio の CLI フラグを受け付けません。それらはすべて prompt に記述してください(例: "vertical 9:16 mobile poster", "1024x1024 square")。レイテンシ: 60〜300 秒。

使用例

例1: 公式の text-to-image を精密に制御

例2: 公式の画像編集(参照画像)

例3: 公式の複数画像融合

例4: 逆会話式(サイズは prompt で指定)

例5: AIコーディングツールから呼び出す

インストール後は、Cursor / Codex CLI などでアシスタントにそのまま依頼するだけです。
  • 「apiyi-gpt-image-2-gen を使って 3840x2160 の高品質なサイバーパンク都市の壁紙を生成して」
  • 「apiyi-gpt-image-2-all-gen を呼び出して photo.jpg をスタジオジブリ風に変換して」
  • 「公式スキルを使って 1:1 のロゴを高品質、webp 形式で作成して」
アシスタントが適切なスキルを選び、CLI のフラグを組み立ててくれます。

FAQ

  • 正確なサイズ(例: 3840×2160)、品質段階(low/medium/high)、または特定の出力フォーマット(webp / compression)が必要な場合 → 公式 apiyi-gpt-image-2-gen を選んでください
  • ChatGPT と同等の会話フロー1回ごとの一律料金($0.03)、強力なテキスト描画を重視し、サイズを自然言語で表現しても問題ない場合 → リバース apiyi-gpt-image-2-all-gen を選んでください
  • 完全な比較: 公式版とリバース版の比較
  1. Node.js がインストールされていることを確認してください(node -v
  2. GitHub へのネットワークアクセスを確認してください
  3. npx skills が利用できない場合は、手動でクローンしてください:
その後、skills/apiyi-gpt-image-2-gen または skills/apiyi-gpt-image-2-all-gen のどちらかをローカルの Skills ディレクトリにコピーしてください。
  1. APIYI_API_KEY が正しく設定されていることを確認してください(sk- で始まります)
  2. 残高 — 残高は十分に見えるのに呼び出しに失敗する を参照してください
  3. 簡単なテストとして、-k "sk-xxx" をインラインで渡してください
カスタム size は次を満たす必要があります:
  • 各辺は 3840px 以下
  • 両方の寸法が 16 で割り切れること
  • 総ピクセル数が 655,360 から 8,294,400 の間であること たとえば、2048x3072 は有効です。3000x2000 は 3000 が 16 で割り切れないため拒否されます。
リバーススキルのデフォルトの R2 CDN URL は、おおよそ 24時間 有効です。本番では、Base64 を受け取ってローカルに保存するために -r b64_json を渡すか、すぐにアセットをダウンロードしてください。
確認済み: Codex CLI、OpenCode、Gemini CLI、GitHub Copilot、Cursor、Amp。Skills に対応したツールであれば、どれでも動作するはずです。

関連リソース

gpt-image-2(公式)ドキュメント

ネイティブな2K/4K画像生成、tokenごとの課金

gpt-image-2-all(リバース)ドキュメント

ChatGPTとの同等性、$0.03/回

公式版 vs リバース版の比較

17項目の並列比較

Nano Banana Pro スキル(同じ作者)

同じリポジトリの姉妹スキル — Gemini 画像生成

Luck GPT-Image 2 ComfyUI Nodes

同じモデル、ComfyUIノード風

APIYI コンソール

キー、利用状況、チャネルを管理