Skip to main content

Обзор

API модерации текста использует передовые модели ИИ для автоматического обнаружения и определения потенциальных рисков в текстовом контенте, помогая вам создавать безопасные и соответствующие требованиям приложения.
Поддерживает модели модерации OpenAI и другие распространенные модели модерации контента с высокой точностью и быстрой реакцией.

Ключевые возможности

Обнаружение нарушений

Выявляйте нарушения, такие как насилие, порнография и язык ненависти

Фильтр вредоносного контента

Обнаруживайте вредоносную информацию, такую как самоповреждение, домогательства и мошенничество

Многоязычная поддержка

Поддерживайте модерацию на китайском, английском и других языках

Детализированная классификация

Предоставляйте подробные категории нарушений и оценки уверенности

Быстрый старт

Базовый вызов API

Используйте Moderation API, чтобы определить, нарушает ли текстовый контент политики:

Пример пакетного обнаружения

Определяйте несколько текстов одновременно:

Категории модерации

Поддерживаемые категории модерации OpenAI

Разные модели могут поддерживать разные категории модерации. Пожалуйста, выберите подходящую модель в соответствии с вашими потребностями.

Структура ответа

Формат ответа

Описание полей

flagged

Логическое значение, указывающее, обнаружены ли нарушения

categories

Результаты бинарной оценки для каждой категории

category_scores

Оценки уверенности для каждой категории (0-1)

Примеры интеграции

Модерация контента в чате

Интегрируйте модерацию контента в чат-приложениях:

Фильтрация UGC (контента, созданного пользователями)

Фильтруйте пользовательский контент на форумах, в комментариях и т. д.:

Модерация контента, созданного ИИ

Вторичная модерация для контента, созданного ИИ:

Расширенное использование

Настраиваемые пороги модерации

Настраивайте строгость модерации в зависимости от бизнес-потребностей:

Журналирование модерации

Записывайте историю модерации для анализа и улучшения:

Совместная модерация несколькими моделями

Объединяйте несколько моделей модерации для более высокой точности:

Лучшие практики

1. Двунаправленная модерация

Модерация входных данных

Модерируйте ввод пользователя, чтобы предотвратить вредоносные запросы

Модерация выходных данных

Модерируйте контент, сгенерированный AI, чтобы обеспечить безопасный вывод

2. Асинхронная модерация

Используйте асинхронную модерацию для сценариев без обработки в реальном времени, чтобы повысить производительность:

3. Кэшируйте результаты модерации

Кэшируйте результаты модерации для одинакового контента, чтобы уменьшить число вызовов API:

4. Многоуровневая обработка

Применяйте разные действия в зависимости от степени нарушения:

FAQ

Поддерживает ли модерация китайский язык?

Да. OpenAI Moderation и другие основные модели модерации поддерживают модерацию китайского контента с точностью, сопоставимой с английским.

Какова задержка модерации?

Обычно от 100 до 500 мс, в зависимости от:
  • Длины текста
  • Выбора модели
  • Сетевых условий

Как обрабатывать ложные срабатывания?

Рекомендуется многоуровневая стратегия:
  1. Нарушения с высокой степенью уверенности: прямой отказ
  2. Средняя степень уверенности: ручная проверка
  3. Низкая степень уверенности: разрешить или предупредить

Взимается ли плата за модерацию?

OpenAI Moderation API в настоящее время бесплатен. Другие модели могут взимать плату. Подробности см. в Цены.

Можно ли модераировать изображения и видео?

Текущий Moderation API в основном ориентирован на текстовый контент. Для модерации изображений и видео требуются специализированные мультимодальные модели модерации.

Связанная документация

Генерация текста

Документация API Chat Completions

Безопасность контента

Политики безопасности контента платформы

Тарифы

Сведения о тарифах API Moderation