Skip to main content

功能概述

文本稽核(Moderation)API 基於先進的 AI 模型,能夠自動檢測和識別文本內容中的潛在風險,幫助你構建安全、合規的應用程式。
支援 OpenAI Moderation 模型及其他主流內容稽核模型,準確率高,響應速度快。

主要能力

違規內容檢測

識別暴力、色情、仇恨等違規內容

有害資訊過濾

檢測自殘、騷擾、欺詐等有害資訊

多語言支援

支援中文、英文等多語言內容稽核

細粒度分類

提供詳細的違規類別和置信度評分

快速開始

基礎呼叫示例

使用 Moderation API 檢測文本內容是否違規:

批次檢測示例

一次性檢測多段文本:

稽核類別

OpenAI Moderation 支援的類別

不同模型支援的稽核類別可能有所不同,請根據實際需求選擇合適的模型。

返回結果詳解

響應結構

欄位說明

flagged

布林值,是否檢測到違規內容

categories

各類別的二元判斷結果

category_scores

各類別的置信度評分(0-1)

整合示例

聊天內容稽核

在聊天應用中整合內容稽核:

UGC(使用者生成內容)過濾

在論壇、評論區等場景過濾使用者內容:

AI 生成內容稽核

對 AI 生成的內容進行二次稽核:

高階用法

自定義稽核閾值

根據業務需求調整稽核嚴格程度:

稽核日誌記錄

記錄稽核歷史,用於分析和改進:

多模型聯合稽核

結合多個稽核模型提高準確性:

最佳實踐

1. 雙向稽核

輸入稽核

稽核使用者輸入,防止惡意請求

輸出稽核

稽核 AI 生成內容,確保輸出安全

2. 非同步稽核

對於非即時場景,使用非同步稽核提升效能:

3. 快取稽核結果

對於相同內容,快取稽核結果減少 API 呼叫:

4. 分級處理

根據違規程度採取不同措施:

常見問題

稽核是否支援中文?

支援。OpenAI Moderation 和其他主流稽核模型都支援中文內容稽核,準確率與英文相當。

稽核延遲是多少?

通常在 100-500ms 之間,具體取決於:
  • 文本長度
  • 模型選擇
  • 網路狀況

如何處理誤判?

建議採取分級策略:
  1. 高置信度違規:直接拒絕
  2. 中等置信度:人工複審
  3. 低置信度:放行或提示

稽核是否收費?

OpenAI Moderation API 目前免費,其他模型可能收費,詳見 定價說明

可以稽核圖片和影片嗎?

當前 Moderation API 主要針對文本內容。圖片和影片稽核需要使用專門的多模態稽核模型。

相關文件

文本生成

Chat Completions API 文件

內容安全

平臺內容安全政策

錯誤處理

API 錯誤處理最佳實踐

定價說明

稽核 API 定價詳情