Обзор
doubao-seedance-2-0-260128 (стандартная), doubao-seedance-2-0-fast-260128 (быстрая) и doubao-seedance-2-0-mini-260615 (mini/lite) — новейшее семейство моделей ByteDance для генерации видео — три модели, работающие параллельно, доступные через APIYI на официальных ресурсах Volcengine в материковом Китае (не международной версии BytePlus) со встроенными механизмами безопасности контента на стороне upstream. Они поддерживают text-to-video, image-to-video по первому+последнему/первому кадру и мультимодальные входы (0-9 референсных изображений + 0-3 референсных видео / 0-3 референсных аудио) — и могут генерировать голос, звуковые эффекты и фоновую музыку, синхронизированные с визуальным рядом. Mini, добавленный в июне 2026 года, — наиболее экономичный вариант: примерно вдвое ниже цена за единицу, чем у стандартной модели, и более быстрая генерация, с ограничением до 720p.-1 для длины, выбранной моделью), три уровня разрешения (480p/720p/1080p; 1080p только у стандартной модели), 6 соотношений сторон плюс адаптивное, синхронизированное аудио включено по умолчанию, а также многоязычные prompts (китайский, английский, японский, испанский, португальский, индонезийский). Предназначено для производства коротких видео, материалов для e-commerce, motion design и контента с виртуальными персонажами в масштабе.Справочник по API генерации видео
POST /seedance/api/v3/contents/generations/tasks — эндпоинт асинхронных задач с интерактивной песочницей и полным кодом для опроса/загрузки.Руководство по API
Визуальное тестирование API
Поиск / загрузка асинхронных задач
Почему Seedance 2.0 от APIYI?
Сначала о позиционировании: у этой модели нет официальной скидки, и APIYI не назначает цену с целью прибыли — она предлагается, чтобы обеспечивать поставки и обслуживать клиентов. Реальная ценность использования APIYI — не «дешевле», а доступ и опыт:Официальный ресурс · Материковая версия
Неограниченные параллельные запросы · Без очереди
running без очереди (измерено 2026-06-06 (UTC+8)) — готово для пакетного производства в масштабе.Ценообразование в пользу поставок · На уровне официального канала
Доступ без лишних шагов · Без проверки личности
api.apiyi.com с одним Token.Доступ по whitelist для virtual-face
Профессиональная поддержка
Ключевые возможности
Три уровня · Одинаковая цена за уровень
Синхронизированное аудио по умолчанию
generate_audio по умолчанию true: голос, звуковые эффекты и фоновая музыка генерируются в соответствии с визуальным рядом. Помещайте произносимые реплики в двойные кавычки, чтобы улучшить качество озвучки.Настраиваемая длительность 4-15 с
duration принимает целые секунды от 4 до 15 или -1, чтобы модель сама выбрала длительность (тарификация по фактическому результату). Фиксированные 24 fps.Многоязычные Prompts
Первый+последний / Первый кадр
return_last_frame, чтобы объединять клипы в более длинные непрерывные видео.Мультимодальный Reference-to-Video
Поток асинхронных задач
task_id, отслеживайте статус, затем скачайте mp4 из content.video_url (ссылка действительна 24 часа).Воспроизводимые seeds
seed для похожих результатов между запусками. watermark по умолчанию false — вывод без водяного знака.Цены
tokens ≈ (input video duration + output duration)(s) × output width × output height × 24 / 1024 (длительность входного видео равна 0 для генерации видео по тексту/изображению; подтверждено в наших тестах с точностью до 0.1%). Поскольку у каждого соотношения в пределах уровня одинаковая площадь пикселей, цена зависит только от уровня разрешения, длительности вывода и наличия видео во входных данных.
Официальные ценовые ориентиры (16:9 / 5 s вывод, CNY за видео)
① Без входного видео (text-to-video / image-to-video / референсные изображения):video_url; входное видео 2-15 s, нижняя граница ≈ 2-4 s входа, верхняя граница ≈ 15 s входа):
usage.completion_tokens.usage.completion_tokens.
- Итоговые списания следуют ценам модели в консоли и журналам вызовов
- Задачи предварительно тарифицируются при отправке и окончательно рассчитываются при завершении — ваш баланс на короткое время колеблется; сверяйте по журналам вызовов, где одно видео дает две записи о списании (см. «Чтение списаний в журналах» ниже)
- Отклоненные запросы (ошибки параметров HTTP 400 и т. п.) не тарифицируются (проверено)
- Стоимость линейно растет с длительностью: видео 15 s стоит примерно в 3× больше, чем 5 s
Чтение списаний в логах (предварительное списание + урегулирование)
Откройте страницу логов консоли по адресуapi.apiyi.com/log и найдите название модели doubao-seedance-2-0, чтобы увидеть каждое списание. Одно видео порождает две записи о списании:
- Предварительное списание: оценочная сумма, которая списывается при отправке задачи (запись лога с меткой “non-streaming”, где показаны token и группа) — $0.449998 на снимке ниже
- Урегулирование (списание или возврат): после завершения задачи разница урегулируется по фактически сгенерированным token (запись лога с меткой “streaming”, со счетчиком completion-token) — $5.611858 ниже; 1080p обычно влечет дополнительное списание

Two charge entries for one 15 s 1080p video: pre-charge + settlement
- Временная метка первой записи (предварительное списание) — это время отправки видео; значение “first byte” показывает, сколько времени заняла отправка, чтобы вернуть ID задачи (например,
首字节:3秒/ first byte: 3 s) — не время генерации - Запись урегулирования показывает
流式(streaming) и首字节:<1秒(first byte менее 1 s) — это лишь внутренние маркеры в записи урегулирования, не признак какой-либо проблемы - Фактическое время генерации видео находится в столбце “耗时” (elapsed) на странице “Async tasks” (
api.apiyi.com/task) в верхней навигации

The first log entry's timestamp = submission time, and its first-byte value (3 s) is the submission latency; this fast example settled as a refund (negative amount), total cost 0.360000 − 0.022750 = 0.337250 USD

The elapsed column on the Async tasks page is the actual video generation time, e.g. 158 s, 303 s
api.apiyi.com/task, и они полностью совпадают со списаниями:
Настройка группы
Seedance 2.0 работает в выделеннойSeeDance2 группе (ставка 0.18x, номинирована в CNY), при двух жестких требованиях: ① модель тарификации Token должна быть Pay-as-you-go Priority (или Pay-as-you-go) — Token с оплатой за каждый запрос не могут маршрутизироваться; ② у Token должна быть включена группа SeeDance2. Token в группе Default или других видео-группах завершатся ошибкой «no available channel for this model».
Технические характеристики
Эндпоинты API
Подробно о разрешениях и соотношениях сторон
Уровень разрешения определяет площадь в пикселях, а не короткую сторону. Фактические размеры вывода для каждого соотношения сторон (официальные значения, подтвержденные в наших тестах):Как работает адаптивный режим
- Текст-в-видео: модель определяет наилучшее соотношение сторон из вашего prompt
- First+last / первый кадр: соответствует соотношению сторон изображения первого кадра (несовпадающие изображения обрезаются по центру)
- Мультимодальный reference-to-video: следует намерению prompt, а иначе — первому медиаэлементу (video имеет приоритет над images)
- Фактическое использованное соотношение сторон возвращается в поле
ratioответа задачи
Лучшие практики
Выбирайте модель в зависимости от требований к выходу
doubao-seedance-2-0-260128 для 1080p или максимального качества; выбирайте lite-модель doubao-seedance-2-0-mini-260615 для пакетного производства и нагрузок, чувствительных к стоимости (примерно вдвое дешевле стандартной и с самой быстрой генерацией, с ограничением 720p); выбирайте fast как компромиссный вариант.Используйте adaptive, чтобы избежать обрезки
adaptive по умолчанию, чтобы модель соответствовала соотношению сторон исходного изображения. Фиксируйте 9:16 (портретная) или 16:9 (альбомная) только когда это требуется целевой платформой.Длительность — ваш регулятор стоимости
duration: -1, когда темп лучше оставить на усмотрение модели.Выключайте аудио, когда оно не нужно
generate_audio по умолчанию true. Передайте false для немого материала, если планируете озвучить его сами.Заключайте диалоги в кавычки для лучшей озвучки
Добавляйте Accept-Encoding: identity в HTTP-клиентах
content-encoding: gzip, хотя тело не сжато; клиенты с автоматическим распаковыванием, такие как Python requests, вызывают ContentDecodingError. Добавление заголовка Accept-Encoding: identity позволяет избежать этого (curl это не затрагивает).Опрос каждые 15-30 s и немедленная загрузка
content.video_url — это подписанная ссылка, действительная 24 часа; сразу скопируйте файл в свое хранилище, как только задача успешно завершится.Связывайте клипы с return_last_frame
return_last_frame: true, чтобы получить последний кадр png без водяного знака, а затем используйте его как первый кадр следующей задачи, чтобы создавать непрерывные видео из нескольких клипов.Коды ошибок и повторные попытки
- Тайм-ауты запросов 30-60 s достаточны для вызовов create/poll (ожидание происходит на стороне задачи)
- Выполняйте опрос каждые 15-30 s с общим бюджетом 15+ минут (дольше для задач 1080p / 15 s)
- Применяйте экспоненциальную задержку между повторными попытками на 5xx и тайм-аутах (2 retries)
- Логируйте идентификатор задачи
idи заголовок ответаx-request-idдля диагностики
Частые вопросы
У меня ошибка 'no available channel for this model' — почему?
У меня ошибка 'no available channel for this model' — почему?
SeeDance2. Токены из группы Default или других групп видео не могут быть направлены на эту модель. Включите группу SeeDance2 в настройках Token и используйте модель тарификации Pay-as-you-go Priority.Python requests выдает ошибки gzip / возвращает обрезанные не-JSON тела
Python requests выдает ошибки gzip / возвращает обрезанные не-JSON тела
content-encoding: gzip у шлюза не совпадает с фактической кодировкой тела. Симптомы включают ContentDecodingError, обрезанное тело не-JSON (например, теряется начальный {" и вы получаете только id":"cgt-xxx"}), или периодические 400. Добавьте "Accept-Encoding": "identity" в заголовки запроса; curl и browser fetch это не затрагивает.Почему у моего видео есть звук? Как его отключить?
Почему у моего видео есть звук? Как его отключить?
generate_audio по умолчанию использует true (подтверждено): модель автоматически добавляет голос, звуковые эффекты и фоновую музыку. Для беззвучного результата явно передайте "generate_audio": false.Где находится URL видео и почему он перестает работать?
Где находится URL видео и почему он перестает работать?
content.video_url в ответе poll (не на верхнем уровне). Это подписанная ссылка, действительная примерно 24 часа — немедленно скачайте ее и перенесите на свой хостинг. Сам task_id можно запрашивать в течение 7 дней.Какое значение статуса успеха?
Какое значение статуса успеха?
queued → running → succeeded / failed / expired. Состояние успеха — succeeded, а не completed — типичная ошибка при миграции с других video APIs.Могу ли я загружать фотографии реальных людей для image-to-video?
Могу ли я загружать фотографии реальных людей для image-to-video?
asset://), или использовать лицензированные ассеты с лицами.Будут ли с меня списаны средства за неудачные или отклоненные запросы?
Будут ли с меня списаны средства за неудачные или отклоненные запросы?
Как оценить расход token? Портретный режим дороже?
Как оценить расход token? Портретный режим дороже?
tokens ≈ duration(s) × width × height × 24 / 1024, подтверждено с точностью до 0.1%. У каждого соотношения сторон в одном уровне одинаковая площадь в пикселях (720p 16:9 и 9:16 оба стоят 108,900 tokens за 5 s) — альбомный, портретный и квадратный режимы стоят одинаково.Standard vs fast vs mini — что выбрать?
Standard vs fast vs mini — что выбрать?
Что делает duration: -1?
Что делает duration: -1?
duration задачи. Задайте duration явно, если важна предсказуемость стоимости.Поддерживается ли параметр frames для дробных секунд?
Поддерживается ли параметр frames для дробных секунд?
frames и camera_fixed — это параметры Seedance 1.x — не поддерживаются серией Seedance 2.0. Вместо этого используйте duration с целыми секундами.Можно ли сочетать first+last frame, first frame и reference images?
Можно ли сочетать first+last frame, first frame и reference images?
first_frame/last_frame), first frame (1 изображение) и мультимодальный reference-to-video (0-9 изображений + 0-3 видео + 0-3 аудио, минимум 1 изображение или 1 видео, роль изображения reference_image). Чтобы приблизить «first/last frame + reference», используйте режим reference и укажите кадр через prompt.Есть ли лимиты на concurrency или очереди?
Есть ли лимиты на concurrency или очереди?
Есть ли ограничения на prompt?
Есть ли ограничения на prompt?
Связанные документы
- Справочник API генерации видео и Playground -
POST /seedance/api/v3/contents/generations/tasks - Генерация видео Sora 2 - официальный релейный видео-канал OpenAI
- Генерация видео VEO 3.1 - официальный видео-канал Google
- Бонусы за пополнение - эффективная стоимость примерно на уровне официального канала
- Руководство по API - общие правила вызова