개요
doubao-seedance-2-0-260128 (표준), doubao-seedance-2-0-fast-260128 (빠른), 그리고 doubao-seedance-2-0-mini-260615 (mini/lite)은 ByteDance의 최신 동영상 생성 모델군으로, 세 모델이 병렬로 운영되며 공식 Volcengine 중국 본토 리소스를 통해 APIYI에서 제공됩니다( BytePlus 국제판이 아닙니다). 상위단 콘텐츠 안전 기능이 내장되어 있습니다. 텍스트-투-비디오, 첫+마지막/첫 프레임 이미지-투-비디오, 그리고 멀티모달 입력(참조 이미지 0-9개 + 참조 동영상 0-3개 / 참조 오디오 0-3개)을 지원하며, 음성, 효과음, 배경 음악을 영상과 동기화해 생성할 수 있습니다. 2026년 6월에 추가된 Mini는 비용 효율성이 가장 높은 선택으로, 표준 모델 단가의 약 절반이면서 생성 속도도 더 빠르고, 최대 720p로 제한됩니다.-1의 모델 선택 길이), 세 가지 해상도 단계(480p/720p/1080p; 1080p는 표준 모델만 지원), 6개 화면비와 적응형, 동기화 오디오 기본 활성화, 그리고 다국어 prompt(중국어, 영어, 일본어, 스페인어, 포르투갈어, 인도네시아어). 숏폼 영상 제작, 이커머스 소재, 모션 디자인, 가상 휴먼 콘텐츠를 대규모로 제작하도록 설계되었습니다.동영상 생성 API 레퍼런스
POST /seedance/api/v3/contents/generations/tasks — 대화형 Playground와 전체 폴링/다운로드 코드가 포함된 비동기 작업 엔드포인트입니다.API 매뉴얼
시각적 API 테스트
비동기 작업 조회 / 다운로드
왜 APIYI의 Seedance 2.0인가요?
먼저 포지셔닝에 대한 메모입니다. 이 모델에는 공식 할인은 없고, APIYI도 이 모델을 수익 목적으로 가격 책정하지 않습니다 — 공급을 안정적으로 확보하고 고객을 서비스하기 위해 제공합니다. APIYI를 통해 이용할 때의 진짜 가치는 “더 저렴함”이 아니라 접근성과 경험입니다:공식 리소스 · 중국 본토 버전
무제한 동시 실행 수 · 대기열 없음
running에 즉시 진입했으며 대기열은 전혀 없었습니다(2026-06-06 (UTC+8) 측정) — 대규모 배치 생산에 바로 사용할 수 있습니다.공급 우선 가격 · 공식과 동일 수준
마찰 없는 접근 · 신원 인증 불필요
api.apiyi.com에 직접 접속할 수 있습니다.가상 얼굴 화이트리스트 접근
전문 지원
주요 기능
3단계 · 단계별 동일 가격
기본 동기화 오디오
generate_audio의 기본값은 true입니다. 음성, 음향 효과, 배경 음악이 시각 요소에 맞게 생성됩니다. 음성 해설 품질을 높이려면 대사를 큰따옴표로 감싸십시오.4-15초 조절 가능 길이
duration은 4초에서 15초 사이의 정수 초를 받거나 -1으로 모델이 길이를 정하도록 할 수 있습니다(실제 출력 기준 과금). 24 fps 고정입니다.다국어 prompt
첫+마지막 / 첫 프레임
return_last_frame과 결합하면 클립을 이어 더 긴 연속 동영상으로 만들 수 있습니다.멀티모달 참조-비디오
비동기 작업 흐름
task_id를 받고, 상태를 폴링한 다음 content.video_url에서 mp4를 다운로드합니다(링크는 24시간 동안 유효합니다).재현 가능한 시드
seed을 고정하면 실행 간 유사한 결과를 얻을 수 있습니다. watermark의 기본값은 false이며, 출력에는 워터마크가 없습니다.요금
tokens ≈ (input video duration + output duration)(s) × output width × output height × 24 / 1024 (텍스트-/이미지-to-video의 경우 입력 video 길이는 0입니다. 당사 테스트에서 0.1% 이내로 검증되었습니다). 티어 내 모든 비율은 같은 픽셀 면적을 가지므로, 가격은 해상도 티어, 출력 길이, 입력에 video가 포함되는지 여부에만 좌우됩니다.
공식 가격 기준 (16:9 / 5초 출력, 동영상당 CNY)
① 입력 동영상 없음 (텍스트-투-동영상 / 이미지-투-동영상 / 참조 이미지):video_url를 포함한 멀티모달 참조; 입력 동영상 2-15초, 하한 ≈ 입력 2-4초, 상한 ≈ 입력 15초):
usage.completion_tokens입니다.usage.completion_tokens입니다.
- 최종 청구는 콘솔의 모델 과금과 호출 로그를 따릅니다
- 작업은 제출 시 선청구되고 완료 시 정산됩니다 — 잔액이 잠시 변동하며, 호출 로그와 대조해야 합니다. 동영상 하나당 두 개의 청구 항목이 생성됩니다(아래 “로그에서 청구 내역 읽기” 참조)
- 거부된 요청(HTTP 400 매개변수 오류 등)은 과금되지 않습니다(검증됨)
- 비용은 지속 시간에 비례합니다. 15초 동영상은 5초 동영상의 약 3배입니다
로그에서 과금 읽기 (사전 과금 + 정산)
api.apiyi.com/log의 콘솔 로그 페이지를 열고 모델 이름 doubao-seedance-2-0을 검색하면 모든 과금 내역을 볼 수 있습니다. 비디오 하나는 과금 항목을 2개 생성합니다:
- 사전 과금: 작업이 제출될 때 차감되는 추정 금액입니다(“비스트리밍”으로 표시된 로그 항목이며, token과 그룹을 보여줍니다) — 아래 스크린샷에서는 $0.449998입니다
- 정산(과금 또는 환불): 작업이 완료된 뒤 실제 생성된 tokens를 기준으로 차액을 정산합니다(“streaming”으로 표시된 로그 항목이며, completion-token 수가 있습니다) — 아래에서는 $5.611858입니다; 1080p는 보통 추가 과금이 발생합니다

Two charge entries for one 15 s 1080p video: pre-charge + settlement
- 첫 번째 항목(사전 과금)의 타임스탬프는 비디오의 제출 시간입니다. 그 “first byte” 값은 제출이 task ID를 반환하는 데 걸린 시간입니다(예:
首字节:3秒/ first byte: 3 s) — 생성 시간이 아닙니다 - 정산 항목에는
流式(streaming)와首字节:<1秒(1초 미만의 first byte)가 표시됩니다 — 이는 정산 기록의 내부 표식일 뿐이며, 문제가 있다는 신호가 아닙니다 - 비디오의 실제 생성 시간은 상단 내비게이션의 “Async tasks” 페이지(
api.apiyi.com/task)에 있는 “耗时” (elapsed) 열입니다

The first log entry's timestamp = submission time, and its first-byte value (3 s) is the submission latency; this fast example settled as a refund (negative amount), total cost 0.360000 − 0.022750 = 0.337250 USD

The elapsed column on the Async tasks page is the actual video generation time, e.g. 158 s, 303 s
api.apiyi.com/task 상단의 “Async tasks” 아래에서 확인할 수 있으며, 과금과 정확히 일치합니다:
그룹 설정
Seedance 2.0은 전용SeeDance2 그룹에서 실행됩니다(0.18x 요율, CNY 기준). 다만 두 가지 엄격한 필수 조건이 있습니다. ① Token의 과금 모델은 종량제 우선순위(또는 종량제)여야 하며 — 요청당 과금 tokens는 라우팅할 수 없습니다; ② Token에 SeeDance2 그룹이 활성화되어 있어야 합니다. 기본 그룹이나 다른 동영상 그룹의 Token은 “이 모델에 사용할 수 있는 채널이 없습니다” 오류로 실패합니다.
기술 사양
API 엔드포인트
해상도 및 종횡비 자세히 보기
해상도 티어는 짧은 변이 아니라 픽셀 면적을 정의합니다. 종횡비별 실제 출력 해상도는 다음과 같습니다(공식 값이며, 저희 테스트에서 검증됨).적응형 동작 방식
- 텍스트-투-비디오: 모델이 prompt에서 가장 적합한 비율을 추론합니다
- 첫 프레임+마지막 프레임 / 첫 프레임: 첫 프레임 이미지의 비율과 일치합니다(불일치하는 이미지는 중앙 기준으로 잘립니다)
- 멀티모달 참조-투-비디오: prompt 의도를 따르며, 그렇지 않으면 첫 번째 미디어 항목을 따릅니다(비디오는 이미지보다 우선합니다)
- 실제로 사용된 비율은 작업 응답의
ratio필드에 반환됩니다
모범 사례
출력 요구 사항에 따라 모델을 선택합니다
doubao-seedance-2-0-260128을 선택하고, 배치 제작과 비용 민감한 워크로드에는 경량 모델 doubao-seedance-2-0-mini-260615을 선택합니다(표준 가격의 절반 정도이고 생성 속도가 가장 빠름, 최대 720p로 제한됨). 중간 선택지로는 fast을 선택합니다.잘림을 피하려면 adaptive를 사용합니다
adaptive를 유지하여 모델이 원본 이미지의 비율에 맞추도록 합니다. 대상 플랫폼이 요구할 때만 9:16(세로) 또는 16:9(가로)를 고정합니다.지속 시간은 비용 조절 다이얼입니다
duration: -1를 사용합니다.필요하지 않으면 오디오를 끕니다
generate_audio는 기본값이 true입니다. 직접 음원을 입힐 계획인 무음 영상에는 false를 전달합니다.더 나은 보이스오버를 위해 대사를 따옴표로 감쌉니다
HTTP 클라이언트에서 Accept-Encoding: identity를 추가합니다
content-encoding: gzip로 표시하지만 본문은 압축되지 않은 상태입니다. Python requests 같은 자동 압축 해제 클라이언트는 ContentDecodingError를 발생시킵니다. Accept-Encoding: identity 헤더를 추가하면 이 문제를 피할 수 있습니다(curl은 영향을 받지 않습니다).15-30초마다 폴링하고 즉시 다운로드합니다
content.video_url는 24시간 동안 유효한 서명된 링크입니다 — 작업이 성공하자마자 파일을 자체 저장소로 복사합니다.return_last_frame으로 클립을 연결합니다
return_last_frame: true를 설정한 다음, 다음 작업의 첫 프레임으로 사용해 연속적인 멀티 클립 동영상을 만듭니다.오류 코드 및 재시도
- 30-60 s 요청 타임아웃이면 create/poll 호출에 충분합니다(대기는 작업 측에서 발생합니다)
- 15-30 s마다 폴링하고 전체 예산은 15분 이상으로 설정하십시오(1080p / 15 s 작업은 더 길게)
- 5xx와 타임아웃에는 지수 백오프를 적용하십시오(2회 재시도)
- 문제 해결을 위해 작업
id와x-request-id응답 헤더를 기록하십시오
자주 묻는 질문
이 모델에서 'no available channel for this model'이 표시되는 이유는 무엇입니까?
이 모델에서 'no available channel for this model'이 표시되는 이유는 무엇입니까?
SeeDance2 그룹이 활성화되어 있지 않습니다. Default 그룹이나 다른 비디오 그룹의 Token은 이 모델로 라우팅할 수 없습니다. Token 설정에서 SeeDance2 그룹을 활성화하고 Pay-as-you-go Priority 과금 모델을 사용하십시오.Python requests에서 gzip 오류가 발생하거나 잘린 non-JSON 본문이 반환되는 이유는 무엇입니까?
Python requests에서 gzip 오류가 발생하거나 잘린 non-JSON 본문이 반환되는 이유는 무엇입니까?
content-encoding: gzip 헤더가 실제 본문 인코딩과 일치하지 않습니다. 증상에는 ContentDecodingError, 잘린 non-JSON 본문(예: 앞의 {"가 사라지고 id":"cgt-xxx"}만 받는 경우), 또는 간헐적인 400 오류가 포함됩니다. 요청 헤더에 "Accept-Encoding": "identity"를 추가하십시오. curl과 브라우저 fetch에는 영향이 없습니다.내 비디오에 왜 소리가 있습니까? 어떻게 끌 수 있습니까?
내 비디오에 왜 소리가 있습니까? 어떻게 끌 수 있습니까?
generate_audio는 true으로 기본 설정됩니다(검증됨). 이 모델은 음성, 음향 효과, 배경 음악을 자동으로 추가합니다. 무음 출력을 원하면 "generate_audio": false를 명시적으로 전달하십시오.비디오 URL은 어디에 있으며, 왜 더 이상 동작하지 않습니까?
비디오 URL은 어디에 있으며, 왜 더 이상 동작하지 않습니까?
content.video_url에 있습니다(최상위가 아님). 약 24시간 동안 유효한 서명된 링크이므로 즉시 다운로드하여 다시 호스팅하십시오. task_id 자체는 7일 동안 계속 조회할 수 있습니다.성공 상태 값은 무엇입니까?
성공 상태 값은 무엇입니까?
queued → running → succeeded / failed / expired입니다. 성공 상태는 **succeeded**이며, completed가 아닙니다. 다른 비디오 API에서 마이그레이션할 때 쉽게 하는 실수입니다.image-to-video에 실제 사람 사진을 업로드할 수 있습니까?
image-to-video에 실제 사람 사진을 업로드할 수 있습니까?
asset:// IDs)를 사용하거나, 라이선스가 부여된 얼굴 에셋을 사용하십시오.실패하거나 거부된 요청도 과금됩니까?
실패하거나 거부된 요청도 과금됩니까?
token 사용량은 어떻게 추정합니까? 세로형이 더 비쌉니까?
token 사용량은 어떻게 추정합니까? 세로형이 더 비쌉니까?
tokens ≈ duration(s) × width × height × 24 / 1024, 0.1% 이내로 검증됨. 각 등급의 모든 비율은 같은 픽셀 면적을 가집니다(720p 16:9와 9:16은 모두 5초당 108,900 tokens 비용) — 가로형, 세로형, 정사각형 모두 비용이 같습니다.Standard, fast, mini 중 어느 것을 선택해야 합니까?
Standard, fast, mini 중 어느 것을 선택해야 합니까?
duration: -1은 무엇을 합니까?
duration: -1은 무엇을 합니까?
duration 필드에 반환됩니다. 비용 예측 가능성이 중요하다면 duration을 명시적으로 고정하십시오.frames 매개변수는 소수 초를 지원합니까?
frames 매개변수는 소수 초를 지원합니까?
frames과 camera_fixed는 Seedance 1.x 매개변수이며 — Seedance 2.0 시리즈에서는 지원되지 않습니다. 대신 정수 초 duration를 사용하십시오.first+last frame, first frame, reference 이미지를 섞을 수 있습니까?
first+last frame, first frame, reference 이미지를 섞을 수 있습니까?
first_frame/last_frame 역할이 있는 2개 이미지), first frame(1개 이미지), 그리고 multi-modal reference-to-video(0-9개 이미지 + 0-3개 비디오 + 0-3개 오디오, 최소 1개 이미지 또는 1개 비디오, 이미지 역할 reference_image)입니다. “첫/마지막 프레임 + reference”를 근사하려면 reference 모드를 사용하고 prompt를 통해 프레임을 지정하십시오.동시 실행 수 제한이나 대기열이 있습니까?
동시 실행 수 제한이나 대기열이 있습니까?
prompt 제한이 있습니까?
prompt 제한이 있습니까?
관련 문서
- 동영상 생성 API 레퍼런스 & 플레이그라운드 -
POST /seedance/api/v3/contents/generations/tasks - Sora 2 동영상 생성 - OpenAI 공식 릴레이 동영상 채널
- VEO 3.1 동영상 생성 - Google 공식 동영상 채널
- 충전 보너스 - 실제 비용은 공식 채널과 거의 비슷합니다
- API 매뉴얼 - 일반 호출 규칙