Skip to main content

Обзор

doubao-seedance-2-0-260128 (стандартная), doubao-seedance-2-0-fast-260128 (быстрая) и doubao-seedance-2-0-mini-260615 (mini/lite) — новейшее семейство моделей ByteDance для генерации видео — три модели, работающие параллельно, доступные через APIYI на официальных ресурсах Volcengine в материковом Китае (не международной версии BytePlus) со встроенными механизмами безопасности контента на стороне upstream. Они поддерживают text-to-video, image-to-video по первому+последнему/первому кадру и мультимодальные входы (0-9 референсных изображений + 0-3 референсных видео / 0-3 референсных аудио) — и могут генерировать голос, звуковые эффекты и фоновую музыку, синхронизированные с визуальным рядом. Mini, добавленный в июне 2026 года, — наиболее экономичный вариант: примерно вдвое ниже цена за единицу, чем у стандартной модели, и более быстрая генерация, с ограничением до 720p.
🎬 Основные возможности: 4-15 с настраиваемая длительность (или -1 для длины, выбранной моделью), три уровня разрешения (480p/720p/1080p; 1080p только у стандартной модели), 6 соотношений сторон плюс адаптивное, синхронизированное аудио включено по умолчанию, а также многоязычные prompts (китайский, английский, японский, испанский, португальский, индонезийский). Предназначено для производства коротких видео, материалов для e-commerce, motion design и контента с виртуальными персонажами в масштабе.

Справочник по API генерации видео

POST /seedance/api/v3/contents/generations/tasks — эндпоинт асинхронных задач с интерактивной песочницей и полным кодом для опроса/загрузки.

Руководство по API

Создание token, базовый URL, модели тарификации и общие правила вызова.

Визуальное тестирование API

Отлаживайте этот эндпоинт напрямую в визуальном инструменте тестирования iCover — код не требуется.

Поиск / загрузка асинхронных задач

Просматривайте отправленные видео-задачи и загружайте ссылки на видео в консоли APIYI — запись для просмотра вне API.

Почему Seedance 2.0 от APIYI?

Сначала о позиционировании: у этой модели нет официальной скидки, и APIYI не назначает цену с целью прибыли — она предлагается, чтобы обеспечивать поставки и обслуживать клиентов. Реальная ценность использования APIYI — не «дешевле», а доступ и опыт:

Официальный ресурс · Материковая версия

Официальные ресурсы Volcengine для материкового Китая (не международная версия BytePlus), со встроенной upstream-проверкой безопасности контента. Параметры, ответы и тарификация полностью совпадают с официальным API.

Неограниченные параллельные запросы · Без очереди

В наших тестах 15 одновременных задач сразу попали в running без очереди (измерено 2026-06-06 (UTC+8)) — готово для пакетного производства в масштабе.

Ценообразование в пользу поставок · На уровне официального канала

Официальной скидки нет, и APIYI не получает прибыль с этой модели: цены за единицу соответствуют официальному прайс-листу Volcengine (тарификация на платформе примерно на 10% выше); в сочетании с бонусами за пополнение эффективная стоимость примерно на уровне официального канала, а клиенты с крупным пополнением на некоторых тарифах могут выйти ниже.

Доступ без лишних шагов · Без проверки личности

Не нужен аккаунт Volcengine, не нужна верификация по реальному имени/личности, нет минимального порога трат (пропускаете стартовый депозит CNY 200 и корпоративную верификацию). Дата-центры материкового Китая, residential networks и зарубежные узлы могут напрямую обращаться к api.apiyi.com с одним Token.

Доступ по whitelist для virtual-face

Канал включает upstream-доступ по virtual-face whitelist: лица, сгенерированные ИИ, и виртуальные аватары можно напрямую использовать для image-to-video, без отдельной заявки на whitelist в официальный канал (реальные человеческие лица по-прежнему ограничены upstream content safety).

Полная линейка моделей для генерации видео

VEO 3.1, Sora 2 и Wan2.7 доступны на одной платформе — комбинируйте их под разные сценарии использования.

Профессиональная поддержка

Команда с опытом работы с нагрузками генерации видео, которая помогает с выбором модели, настройкой и интеграцией от PoC до production.

Ключевые возможности

Три уровня · Одинаковая цена за уровень

480p / 720p / 1080p (только стандартная модель 1080p). В пределах уровня соотношения 16:9, 9:16, 1:1 и любое другое соотношение имеют одинаковую площадь пикселей и одинаковую цену — переключайтесь между альбомной и портретной ориентацией без доплаты.

Синхронизированное аудио по умолчанию

generate_audio по умолчанию true: голос, звуковые эффекты и фоновая музыка генерируются в соответствии с визуальным рядом. Помещайте произносимые реплики в двойные кавычки, чтобы улучшить качество озвучки.

Настраиваемая длительность 4-15 с

duration принимает целые секунды от 4 до 15 или -1, чтобы модель сама выбрала длительность (тарификация по фактическому результату). Фиксированные 24 fps.

Многоязычные Prompts

Китайский (до ~500 символов) и английский (до ~1000 слов), а также японский, испанский, португальский и индонезийский.

Первый+последний / Первый кадр

Зафиксируйте первый и последний кадры двумя изображениями или анимируйте одно изображение как первый кадр. Используйте вместе с return_last_frame, чтобы объединять клипы в более длинные непрерывные видео.

Мультимодальный Reference-to-Video

Смешивайте 0-9 reference images с 0-3 reference videos и 0-3 reference audios (не менее 1 image или 1 video; три image modes взаимоисключающие), чтобы создавать, редактировать или расширять videos, сохраняя согласованность персонажей и стиля.

Поток асинхронных задач

Отправьте запрос и получите task_id, отслеживайте статус, затем скачайте mp4 из content.video_url (ссылка действительна 24 часа).

Воспроизводимые seeds

Зафиксируйте seed для похожих результатов между запусками. watermark по умолчанию false — вывод без водяного знака.

Цены

Ценообразование в двух словах — точная token-тарификация, по уровням привязанная к официальному сайту Volcengine. Три модели имеют разную цену: mini < fast < standard (в том же направлении, что и на официальном сайте; mini стоит примерно вдвое меньше, чем единичная цена standard-модели — это НЕ один и тот же ценовой уровень). Прайс на платформе составляет примерно 1.1× от официального прайса, а с бонусом за пополнение (10% для обычных клиентов, до 20% для клиентов с крупным депозитом) фактическая стоимость практически на уровне официального сайта — на некоторых уровнях (например, цена для крупного клиента на 1080p) даже ниже. Тарификация идет по area×duration, поэтому отклонение в пределах ±5% нормально — вы можете тестировать, сверять и обращаться в любое время.
Тарификация по token: tokens ≈ (input video duration + output duration)(s) × output width × output height × 24 / 1024 (длительность входного видео равна 0 для генерации видео по тексту/изображению; подтверждено в наших тестах с точностью до 0.1%). Поскольку у каждого соотношения в пределах уровня одинаковая площадь пикселей, цена зависит только от уровня разрешения, длительности вывода и наличия видео во входных данных.

Официальные ценовые ориентиры (16:9 / 5 s вывод, CNY за видео)

① Без входного видео (text-to-video / image-to-video / референсные изображения): ② С входным видео (мультимодальный референс, включая video_url; входное видео 2-15 s, нижняя граница ≈ 2-4 s входа, верхняя граница ≈ 15 s входа):
При наличии входного видео тарифицируемая длительность = длительность входного видео + длительность выхода, поэтому это дороже, чем обычный text-/image-to-video; также действует минимальный порог по token (за очень короткие входы тарификация идет по порогу). Авторитетное использование — возвращаемый usage.completion_tokens.
Сравнение, измеренное на платформе (протестировано в 2026-06 и 2026-07, 16:9 / аудио по умолчанию / без входного видео; CNY по фиксированному курсу 1:7, только для справки):
Три модели НЕ имеют одинаковой цены — никогда не считайте их равными. При одинаковых разрешении/длительности цена за token идет mini < fast < standard (например, 720p/5s: mini ≈ ¥3.16, fast ≈ ¥5.08, standard ≈ ¥6.35), что соответствует официальной ценовой лестнице. Для пакетного производства mini экономит больше всего денег и времени (наши тесты 2026-07 показали, что его эффективная цена за единицу точно совпадает с номинальным тарифом платформы, отклонение 0.00%); 1080p доступно только в standard.
Примечание: «CNY» — это прайс на платформе; «Обычный клиент ÷1.1» и «Крупный клиент ÷1.2» — это эффективные цены после бонуса за пополнение в размере 10% / 20% — после бонуса цены близки к официальному ориентиру, а цена для крупного клиента на 1080p даже ниже официальной. Авторитетное использование — возвращаемый usage.completion_tokens.
Примечания по тарификации:
  • Итоговые списания следуют ценам модели в консоли и журналам вызовов
  • Задачи предварительно тарифицируются при отправке и окончательно рассчитываются при завершении — ваш баланс на короткое время колеблется; сверяйте по журналам вызовов, где одно видео дает две записи о списании (см. «Чтение списаний в журналах» ниже)
  • Отклоненные запросы (ошибки параметров HTTP 400 и т. п.) не тарифицируются (проверено)
  • Стоимость линейно растет с длительностью: видео 15 s стоит примерно в 3× больше, чем 5 s

Чтение списаний в логах (предварительное списание + урегулирование)

Откройте страницу логов консоли по адресу api.apiyi.com/log и найдите название модели doubao-seedance-2-0, чтобы увидеть каждое списание. Одно видео порождает две записи о списании:
  1. Предварительное списание: оценочная сумма, которая списывается при отправке задачи (запись лога с меткой “non-streaming”, где показаны token и группа) — $0.449998 на снимке ниже
  2. Урегулирование (списание или возврат): после завершения задачи разница урегулируется по фактически сгенерированным token (запись лога с меткой “streaming”, со счетчиком completion-token) — $5.611858 ниже; 1080p обычно влечет дополнительное списание
Страница логов APIYI, показывающая две записи о списании для одного видео Seedance 2.0: предварительное списание и урегулирование

Two charge entries for one 15 s 1080p video: pre-charge + settlement

В записи урегулирования не отображаются ни token, ни его группа — это нормально. Сумма двух записей и есть общая стоимость видео.
Как читать поля времени:
  1. Временная метка первой записи (предварительное списание) — это время отправки видео; значение “first byte” показывает, сколько времени заняла отправка, чтобы вернуть ID задачи (например, 首字节:3秒 / first byte: 3 s) — не время генерации
  2. Запись урегулирования показывает 流式 (streaming) и 首字节:<1秒 (first byte менее 1 s) — это лишь внутренние маркеры в записи урегулирования, не признак какой-либо проблемы
  3. Фактическое время генерации видео находится в столбце “耗时” (elapsed) на странице “Async tasks” (api.apiyi.com/task) в верхней навигации
Чтение полей времени и first byte на странице логов: первая запись — это время отправки и задержка отправки

The first log entry's timestamp = submission time, and its first-byte value (3 s) is the submission latency; this fast example settled as a refund (negative amount), total cost 0.360000 − 0.022750 = 0.337250 USD

Страница «Async tasks», показывающая время отправки и прошедшее время генерации каждой видеозадачи

The elapsed column on the Async tasks page is the actual video generation time, e.g. 158 s, 303 s

Для 15 s видео 1080p на первом снимке общая стоимость = 0.449998 + 5.611858 = $6.061856. Соответствующие параметры задачи видны в разделе “Async tasks” в верхней части api.apiyi.com/task, и они полностью совпадают со списаниями:
732,108 completion tokens ≈ 15 × 1248 × 1664 × 24 / 1024 (видео 3:4 в 1080p выдает 1248×1664) — это соответствует формуле тарификации.
Это 15 s видео 1080p в сумме стоит около ¥42.4 (номинальная стоимость по фиксированному курсу 1:7); с бонусом за пополнение эффективная стоимость составляет примерно ¥35-39, тогда как официальный ориентир для тех же параметров — около ¥37.2. Сама официальная цена недешева — стоимость определяется model + resolution + duration (переход на fast / 720p / 5 s гораздо дешевле). Эта модель поставляется с небольшой маржой, чтобы обеспечить доступность, а клиенты с крупным пополнением получают большие скидки.
Уведомление о бета-поставке: Seedance 2.0 сейчас находится на этапе бета-поставки. Если ваши фактические списания заметно отличаются от таблицы выше, обратитесь в службу поддержки, и мы проведем сверку. Цена будет динамически корректироваться с учетом политики upstream (например, если позже выйдет официальный вариант с более низкой ценой) и возможностей поставки APIYI; потенциальным канал-партнерам предлагаем связаться с нами. Эта модель оценивается так, чтобы обеспечить поставки и обслуживать клиентов, а не для прибыли.

Настройка группы

Seedance 2.0 работает в выделенной SeeDance2 группе (ставка 0.18x, номинирована в CNY), при двух жестких требованиях: ① модель тарификации Token должна быть Pay-as-you-go Priority (или Pay-as-you-go) — Token с оплатой за каждый запрос не могут маршрутизироваться; ② у Token должна быть включена группа SeeDance2. Token в группе Default или других видео-группах завершатся ошибкой «no available channel for this model».
Почему 0.18x? Встроенные системные цены за единицу для Seedance 2.0 соответствуют официальным прайс-ценам Volcengine — но этот прайс номинирован в CNY, тогда как балансы APIYI номинированы в USD (фиксированный курс 1:7 USD/CNY). Ставка 1x фактически означала бы списание в 7× от официальной суммы, поэтому ставка группы снижена, чтобы учесть конвертацию валюты: 0.18 × 7 = 1.26, то есть номинальное списание составляет примерно 1.26× официальной цены в CNY. После учета бонуса за пополнение, обычные пользователи платят примерно на 10% больше официальной цены, тогда как клиенты с более высоким уровнем пополнения выходят на паритет или даже ниже него (например, tier 1080p).Обратите внимание: тарификация всегда основывается на фактическом расходе token, а пересчет token сопровождается небольшой естественной вариацией (±5% — это нормально); официальная прайс-цена — лишь ориентир, а не гарантия на каждый запрос. Текущая тарификация — разумная схема с приоритетом предложения, поэтому всегда оценивайте ее вместе с бонусом за пополнение. Если списание выглядит некорректным, мы всегда готовы сверить с вами счета; однако вопрос «почему это немного выше официальной цены» не является предметом спора — пожалуйста, учитывайте это и пропустите этот канал, если это для вас важно. С другой стороны, много параллельных запросов без очередей — именно то, что этот канал и дает.
Две рекомендуемые конфигурации Token:
Для production мы рекомендуем B (выделенный Token): чистая тарификация, контроль квоты по каждому направлению и более простая диагностика при всплесках использования.

Технические характеристики

Эндпоинты API

Домены: api.apiyi.com является основным шлюзом; vip.apiyi.com и другие домены платформы работают идентично. Префикс пути — /seedance/api/v3не удаляйте сегмент /api, и не используйте /v1/videos.

Подробно о разрешениях и соотношениях сторон

Уровень разрешения определяет площадь в пикселях, а не короткую сторону. Фактические размеры вывода для каждого соотношения сторон (официальные значения, подтвержденные в наших тестах):

Как работает адаптивный режим

  1. Текст-в-видео: модель определяет наилучшее соотношение сторон из вашего prompt
  2. First+last / первый кадр: соответствует соотношению сторон изображения первого кадра (несовпадающие изображения обрезаются по центру)
  3. Мультимодальный reference-to-video: следует намерению prompt, а иначе — первому медиаэлементу (video имеет приоритет над images)
  4. Фактическое использованное соотношение сторон возвращается в поле ratio ответа задачи
ratio принимает только 7 значений enum выше — если передать, например, "2:1", возвращается ошибка InvalidParameter (подтверждено), как и при значении duration вне диапазона 4-15. Ни один из случаев не тарифицируется.

Лучшие практики

1

Выбирайте модель в зависимости от требований к выходу

Выбирайте стандартную модель doubao-seedance-2-0-260128 для 1080p или максимального качества; выбирайте lite-модель doubao-seedance-2-0-mini-260615 для пакетного производства и нагрузок, чувствительных к стоимости (примерно вдвое дешевле стандартной и с самой быстрой генерацией, с ограничением 720p); выбирайте fast как компромиссный вариант.
2

Используйте adaptive, чтобы избежать обрезки

Для image-to-video оставляйте значение adaptive по умолчанию, чтобы модель соответствовала соотношению сторон исходного изображения. Фиксируйте 9:16 (портретная) или 16:9 (альбомная) только когда это требуется целевой платформой.
3

Длительность — ваш регулятор стоимости

Стоимость линейно растет с длительностью. Сначала проверяйте prompt на клипах по 5 s, затем переходите к 10-15 s; используйте duration: -1, когда темп лучше оставить на усмотрение модели.
4

Выключайте аудио, когда оно не нужно

generate_audio по умолчанию true. Передайте false для немого материала, если планируете озвучить его сами.
5

Заключайте диалоги в кавычки для лучшей озвучки

Помещайте реплики в prompt в двойные кавычки — модель автоматически сгенерирует подходящие голоса.
6

Добавляйте Accept-Encoding: identity в HTTP-клиентах

Шлюз помечает ответы content-encoding: gzip, хотя тело не сжато; клиенты с автоматическим распаковыванием, такие как Python requests, вызывают ContentDecodingError. Добавление заголовка Accept-Encoding: identity позволяет избежать этого (curl это не затрагивает).
7

Опрос каждые 15-30 s и немедленная загрузка

Задачи обычно завершаются за 2-5 минут. content.video_url — это подписанная ссылка, действительная 24 часа; сразу скопируйте файл в свое хранилище, как только задача успешно завершится.
8

Связывайте клипы с return_last_frame

Установите return_last_frame: true, чтобы получить последний кадр png без водяного знака, а затем используйте его как первый кадр следующей задачи, чтобы создавать непрерывные видео из нескольких клипов.

Коды ошибок и повторные попытки

Рекомендации для клиента:
  • Тайм-ауты запросов 30-60 s достаточны для вызовов create/poll (ожидание происходит на стороне задачи)
  • Выполняйте опрос каждые 15-30 s с общим бюджетом 15+ минут (дольше для задач 1080p / 15 s)
  • Применяйте экспоненциальную задержку между повторными попытками на 5xx и тайм-аутах (2 retries)
  • Логируйте идентификатор задачи id и заголовок ответа x-request-id для диагностики

Частые вопросы

Самая распространенная ошибка Seedance 2.0: в вашем Token не включена группа SeeDance2. Токены из группы Default или других групп видео не могут быть направлены на эту модель. Включите группу SeeDance2 в настройках Token и используйте модель тарификации Pay-as-you-go Priority.
Заголовок content-encoding: gzip у шлюза не совпадает с фактической кодировкой тела. Симптомы включают ContentDecodingError, обрезанное тело не-JSON (например, теряется начальный {" и вы получаете только id":"cgt-xxx"}), или периодические 400. Добавьте "Accept-Encoding": "identity" в заголовки запроса; curl и browser fetch это не затрагивает.
generate_audio по умолчанию использует true (подтверждено): модель автоматически добавляет голос, звуковые эффекты и фоновую музыку. Для беззвучного результата явно передайте "generate_audio": false.
При успехе URL находится в content.video_url в ответе poll (не на верхнем уровне). Это подписанная ссылка, действительная примерно 24 часа — немедленно скачайте ее и перенесите на свой хостинг. Сам task_id можно запрашивать в течение 7 дней.
Машина состояний — queued → running → succeeded / failed / expired. Состояние успеха — succeeded, а не completed — типичная ошибка при миграции с других video APIs.
Нет. Seedance 2.0 отклоняет референсные изображения/видео, содержащие реальные человеческие лица (проверка безопасности контента на стороне источника). Альтернативы: повторно использовать выходные данные с лицами, сгенерированные моделями Seedance за последние 30 дней, использовать предустановленные виртуальные аватары платформы (ID asset://), или использовать лицензированные ассеты с лицами.
Отклонения параметров (HTTP 400) не тарифицируются (подтверждено). Тарификация предварительно списывается при отправке и окончательно рассчитывается при завершении, поэтому ваш баланс кратковременно меняется — сверяйте по журналам вызовов.
tokens ≈ duration(s) × width × height × 24 / 1024, подтверждено с точностью до 0.1%. У каждого соотношения сторон в одном уровне одинаковая площадь в пикселях (720p 16:9 и 9:16 оба стоят 108,900 tokens за 5 s) — альбомный, портретный и квадратный режимы стоят одинаково.
Цена и скорость идут так: mini < fast < standard (номинально на платформе для 720p/5s: примерно ¥3.16 / ¥5.08 / ¥6.35). Выбирайте mini для пакетного производства и задач, чувствительных к стоимости — примерно вдвое дешевле standard и с самой быстрой генерацией (измерено 2026-07: ~1.5-2.5 min для 5 s @720p). Выбирайте standard для 1080p или максимальной детализации, а fast — как промежуточный вариант. И mini, и fast ограничены 720p — запрос 1080p возвращает параметрическую ошибку 400 (не тарифицируется).
Модель выбирает длительность от 4 до 15 s (в нашем тесте получилось видео на 10 s) и тарифицирует по фактическому результату. Итоговая длительность возвращается в поле duration задачи. Задайте duration явно, если важна предсказуемость стоимости.
Нет. frames и camera_fixed — это параметры Seedance 1.x — не поддерживаются серией Seedance 2.0. Вместо этого используйте duration с целыми секундами.
Нет — это три взаимоисключающие режима: first+last (2 изображения с обязательными ролями first_frame/last_frame), first frame (1 изображение) и мультимодальный reference-to-video (0-9 изображений + 0-3 видео + 0-3 аудио, минимум 1 изображение или 1 видео, роль изображения reference_image). Чтобы приблизить «first/last frame + reference», используйте режим reference и укажите кадр через prompt.
Группа SeeDance2 имеет большой запас по параллельным запросам и работает без очереди (15 одновременных задач в нашем тесте запускались сразу). Для более крупных длительных нагрузок обратитесь в отдел продаж.
Держите prompt короче примерно 500 китайских символов или 1000 английских слов — более длинные prompt снижают детализацию. Поддерживаемые языки: китайский, английский, японский, испанский, португальский, индонезийский. Опишите объект + действие + движение камеры + освещение/стиль.

Связанные документы

Seedance 2.0 — одна из немногих видеомоделей первого уровня 2026 года, которая по умолчанию выводит синхронизированный звук. В сочетании с соотношениями сторон по той же цене и лимитом в 15 секунд она является сильным основным каналом для создания коротких видео и e-commerce-материалов. Для сравнения альтернатив тот же Token (с включенными дополнительными группами) может напрямую вызывать Sora 2, VEO 3.1 и Wan2.7.