Skip to main content

概要

Text Moderation API は、高度な AI モデルを使用してテキストコンテンツ内の潜在的なリスクを自動的に検出・識別し、安全でコンプライアンスに準拠したアプリケーションの構築を支援します。
OpenAI Moderation モデルやその他の主流なコンテンツモデレーションモデルをサポートし、高い精度と高速な応答を実現します。

主な機能

違反検出

暴力、ポルノ、ヘイトなどの違反を識別します

有害コンテンツフィルター

自傷行為、嫌がらせ、詐欺などの有害情報を検出します

多言語対応

中国語、英語、その他の言語でのモデレーションをサポートします

きめ細かな分類

詳細な違反カテゴリと信頼度スコアを提供します

クイックスタート

基本API呼び出し

Moderation API を使用して、テキストコンテンツがポリシーに違反しているかを検出します:

バッチ検出の例

複数のテキストを一度に検出します:

モデレーションカテゴリ

OpenAI Moderation 対応カテゴリ

モデルによってサポートするモデレーションカテゴリは異なる場合があります。ご要件に応じて適切なモデルを選択してください。

レスポンス構造

レスポンス形式

フィールドの説明

flagged

違反が検出されたかどうかを示します

categories

各カテゴリの二値判定結果です

category_scores

各カテゴリの信頼度スコアです(0-1)

統合例

チャットコンテンツのモデレーション

チャットアプリケーションにコンテンツモデレーションを統合します:

UGC(ユーザー生成コンテンツ)のフィルタリング

フォーラムやコメントなどでユーザーコンテンツをフィルタリングします:

AI生成コンテンツのモデレーション

AI生成コンテンツに対する二次モデレーション:

高度な使い方

カスタムモデレーションしきい値

ビジネス要件に応じてモデレーションの厳しさを調整します:

モデレーションログ

分析と改善のためにモデレーション履歴を記録します:

複数モデルの共同モデレーション

より高い精度のために複数のモデレーションモデルを組み合わせます:

ベストプラクティス

1. 双方向のモデレーション

入力モデレーション

悪意のあるリクエストを防ぐためにユーザー入力をモデレートします

出力モデレーション

安全な出力を確保するためにAI生成コンテンツをモデレートします

2. 非同期モデレーション

リアルタイムでないシナリオでは、パフォーマンスを向上させるために非同期モデレーションを使用します:

3. モデレーション結果のキャッシュ

API呼び出しを減らすため、同一コンテンツのモデレーション結果をキャッシュします:

4. 段階的な処理

違反の重大度に応じて、異なる対応を取ります:

よくある質問

モデレーションは中国語に対応していますか?

はい。OpenAI Moderation とその他の主要なモデレーションモデルは、英語と同等の精度で中国語コンテンツのモデレーションをサポートしています。

モデレーションのレイテンシーはどのくらいですか?

通常は 100-500ms で、以下によって異なります。
  • テキストの長さ
  • モデルの選択
  • ネットワーク状況

誤検知はどのように扱えばよいですか?

段階的な戦略を推奨します。
  1. 高い確信度の違反: 直接拒否
  2. 中程度の確信度: 人手によるレビュー
  3. 低い確信度: 許可または警告

モデレーションは課金されますか?

OpenAI Moderation API は現在無料です。その他のモデルでは料金が発生する場合があります。詳細は料金をご覧ください。

画像と動画もモデレーションできますか?

現在の Moderation API は主にテキストコンテンツを対象としています。画像と動画のモデレーションには、専用のマルチモーダルモデレーションモデルが必要です。

関連ドキュメント

テキスト生成

Chat Completions API のドキュメント

コンテンツセーフティ

プラットフォームのコンテンツ安全ポリシー

料金

Moderation API の料金詳細