개요
텍스트 모더레이션 API는 고급 AI 모델을 사용하여 텍스트 콘텐츠의 잠재적 위험을 자동으로 탐지하고 식별함으로써 안전하고 규정을 준수하는 애플리케이션을 구축할 수 있도록 돕습니다.OpenAI Moderation 모델 및 기타 주류 콘텐츠 모더레이션 모델을 높은 정확도와 빠른 응답으로 지원합니다.
주요 기능
위반 탐지
폭력, 음란물, 혐오와 같은 위반을 식별합니다
유해 콘텐츠 필터
자해, 괴롭힘, 사기와 같은 유해 정보를 탐지합니다
다국어 지원
중국어, 영어 및 기타 언어의 모더레이션을 지원합니다
세분화된 분류
상세한 위반 범주와 신뢰도 점수를 제공합니다
빠른 시작
기본 API 호출
Moderation API를 사용하여 텍스트 콘텐츠가 정책을 위반하는지 감지합니다:배치 감지 예시
여러 텍스트를 한 번에 감지합니다:모더레이션 카테고리
OpenAI 모더레이션 지원 카테고리
응답 구조
응답 형식
필드 설명
flagged
위반이 감지되었는지 나타내는 불리언
categories
각 카테고리에 대한 이진 판정 결과
category_scores
각 카테고리에 대한 신뢰도 점수 (0-1)
통합 예시
채팅 콘텐츠 모더레이션
채팅 애플리케이션에 콘텐츠 모더레이션을 통합합니다:UGC(사용자 생성 콘텐츠) 필터링
포럼, 댓글 등에서 사용자 콘텐츠를 필터링합니다:AI 생성 콘텐츠 모더레이션
AI 생성 콘텐츠에 대한 2차 모더레이션입니다:고급 사용법
사용자 지정 모더레이션 임계값
비즈니스 요구에 따라 모더레이션 엄격도를 조정합니다:모더레이션 로그 기록
분석 및 개선을 위해 모더레이션 이력을 기록합니다:다중 모델 공동 모더레이션
더 높은 정확도를 위해 여러 모더레이션 모델을 결합합니다:모범 사례
1. 양방향 모더레이션
Input Moderation
악의적인 요청을 방지하기 위해 사용자 입력을 모더레이션합니다
Output Moderation
안전한 출력을 보장하기 위해 AI 생성 콘텐츠를 모더레이션합니다
2. 비동기 모더레이션
실시간이 아닌 시나리오에서는 성능 향상을 위해 비동기 모더레이션을 사용합니다:3. 모더레이션 결과 캐싱
API 호출을 줄이기 위해 동일한 콘텐츠에 대한 모더레이션 결과를 캐싱합니다:4. 단계별 처리
위반 심각도에 따라 다른 조치를 취합니다:자주 묻는 질문
중국어 모더레이션을 지원합니까?
예. OpenAI Moderation 및 다른 주류 모더레이션 모델은 영어와 비슷한 정확도로 중국어 콘텐츠 모더레이션을 지원합니다.모더레이션 지연 시간은 어느 정도입니까?
일반적으로 100-500ms 사이이며, 다음 요소에 따라 달라집니다:- 텍스트 길이
- 모델 선택
- 네트워크 상태
오탐은 어떻게 처리합니까?
단계적 전략을 권장합니다:- 높은 신뢰도의 위반: 즉시 거부
- 중간 신뢰도: 수동 검토
- 낮은 신뢰도: 허용하거나 경고
모더레이션에 과금됩니까?
OpenAI Moderation API는 현재 무료입니다. 다른 모델은 요금이 부과될 수 있습니다. 자세한 내용은 가격을 참고하십시오.이미지와 동영상도 모더레이션할 수 있습니까?
현재 Moderation API는 주로 텍스트 콘텐츠를 대상으로 합니다. 이미지 및 동영상 모더레이션에는 전문화된 멀티모달 모더레이션 모델이 필요합니다.관련 문서
텍스트 생성
Chat Completions API 문서
콘텐츠 안전
플랫폼 콘텐츠 안전 정책
요금
Moderation API 요금 상세