블로그

Seedance 2.5 vs 2.0: 업그레이드의 본체는 입력 자유도, 그리고 아무도 알려주지 않는 3배 청구서

게시 2026-08-10 · 측정일 2026-08-08

저희는 멀티 모델 영상 생성 서비스를 운영합니다. 다시 말해 서비스에 올린 모든 모델의 생성 요금을 건별로 저희 계정에서 지불합니다. Seedance 2.0 옆에 Seedance 2.5를 나란히 놓기 전에, 라우팅을 결정할 때 쓰는 것과 같은 측정 환경에 둘 다 통과시켰습니다. 이 글은 그 데이터를 측정한 그대로 공개한 것입니다.

아래 수치는 전부 2026-08-08부터 2026-08-10 사이의 실제 API 생성에서 나왔고, 요금은 저희 계정에 청구됐습니다. 한 번만 돌린 항목은 그렇다고 밝힙니다. 예상 밖의 수치가 나온 항목은 믿기 전에 다시 돌렸습니다.

요약

  • 길이가 같고 각자 가장 싼 경로를 썼을 때, Seedance 2.5의 편당 비용은 Seedance 2.0의 약 1.7배입니다.
  • 진짜 업그레이드는 초당 화질이 아니라 입력 자유도입니다. 2.5는 참조 이미지 30장, 참조 영상 10개, 참조 오디오 10트랙까지 받고 출력은 30초까지 늘어납니다. 2.0은 첫 프레임과 마지막 프레임 제어에서 멈춥니다.
  • 참조 영상은 출력 영상과 같은 규칙으로, 초 단위로 과금됩니다. 5초 생성에 12.6초짜리 클립을 붙이면 17.6초를 냅니다. 저희가 확인한 건 가격이 아니라 메커니즘입니다. 같은 참조 클립으로 출력 길이만 바꿔 돌린 두 편, 그리고 태스크 생성 응답에서 공급사가 스스로 밝힌 billing_rule: "per_second"가 근거입니다.
  • 작업이 5초짜리 순수 텍스트 투 비디오뿐이라면 2.0이 여전히 합리적인 기본값입니다. 2.5의 웃돈이 값어치를 하기 시작하는 건 브리프에 입력 소재가 두 번째로 들어오는 순간부터입니다.

실제로 달라진 것

Seedance 2.0Seedance 2.5
텍스트 투 비디오지원지원
이미지 투 비디오첫 프레임, 또는 첫 프레임과 마지막 프레임지원, 여기에 다중 이미지 참조
참조 이미지2장(첫 프레임과 마지막 프레임)최대 30장, 순번으로 지정 가능
참조 영상미지원최대 10개
참조 오디오미지원최대 10트랙
출력 길이 상한15초30초
멀티 컷 서사미지원지원

참조 소재는 순번으로 지정할 수 있습니다. 프롬프트에 "이미지 3", "영상 1"이라고 쓰면 모델이 제출 순서에 맞춰 해석합니다. 소재의 배열 순서 자체가 프롬프트의 일부가 된다는 뜻이고, 그 위에 제품을 얹는다면 실제 설계에 영향을 줍니다(저희는 이것 때문에 업로드 화면을 다시 만들었습니다).

실측: 생성 1회당 비용

같은 프롬프트, 5초, 480p, 1회당 1편. 가격은 2026-08-08에 저희 계정에서 실제로 빠져나간 금액이며 단위는 미국 달러입니다.

모델경로 A경로 B
Seedance 2.0 텍스트 투 비디오$0.290재측정 없음
Seedance 2.5 텍스트 투 비디오$0.484$0.687
Seedance 2.5 이미지 투 비디오$0.484$0.687
Seedance 2.5에 12.63초 참조 영상 1개$2.203$1.485

눈여겨볼 지점이 두 가지 있습니다.

첫째, 2.5의 두 경로는 "어느 모드가 싼가"에서 결론이 엇갈립니다. 순수 텍스트 투 비디오에서는 경로 A가 29% 싸지만, 참조 영상을 붙이는 순간 48% 비싸집니다. 텍스트 투 비디오 비교에서 이겼다는 이유로 Seedance 2.5 트래픽을 한 공급사에 몰아주면, 참조 영상이 들어간 작업마다 돈을 더 내게 됩니다. 저희는 결국 모델 단위가 아니라 모드 단위로 라우팅하도록 바꿨습니다.

둘째, 참조 영상을 붙인 생성은 순수 생성의 2.2배에서 3.2배입니다. 이건 할증 요금이 아니라 산수이고, 여기서 저희가 어디에서도 문서를 찾지 못한 영역으로 넘어갑니다.

참조 영상 과금 메커니즘, 두 번의 생성으로 확정하다

참조 영상 모드의 가격 페이지에는 "초당"이라고만 적혀 있고 어떤 초인지는 없습니다. 출력만인지, 출력에 입력을 더하는지, 아니면 정액 할증인지. 이 차이는 저희 같은 서비스가 청구액의 절반을 놓치느냐 마느냐를 결정합니다. 그래서 직접 측정했습니다.

방법은 이렇습니다. 같은 12.67초 참조 클립, 같은 프롬프트, 같은 해상도로 두 번 돌리되 출력 길이만 5초와 10초로 둡니다. 태스크 생성 호출 직전과 직후에 계정 잔액을 읽습니다.

출력청구과금 초초당 단가
5초216.5561 크레딧17.6712.2556
10초277.7302 크레딧22.6712.2510

두 번의 초당 단가가 0.04% 안쪽으로 일치하는 건, 과금 초를 출력에 참조 입력을 더한 값으로 셀 때뿐입니다. 게다가 예상 못 한 일이지만, 공급사의 태스크 생성 응답이 스스로 그렇게 밝히고 있었습니다.

"usage": { "billing_rule": "per_second", "credits_reserved": 277.7302 }

참조 초의 단가를 따로 역산하면 출력 초 단가의 1.0024배가 나옵니다. 참조 초와 출력 초는 같은 값입니다.

한 겹이 더 있습니다. 초당 단가는 모드에 따라 달라집니다. 같은 공급사에서 순수 텍스트 투 비디오는 출력 1초당 $0.1374, 참조 영상 모드는 과금 1초당 $0.0842입니다. 참조 모드는 할인된 단가를 더 큰 초 수에 곱하는 방식입니다.

실무상 결론은 이렇습니다. 5초 생성에 12.6초 참조 클립을 붙이면 17.6초가 과금됩니다. 사용자에게 출력 길이만으로 요금을 매기면 이 건에서 54%를 덜 받게 됩니다. 저희는 이 모드를 열기 전에, 입력 초를 서버에서 계산해 청구하도록 다시 만들었습니다(ffmpeg로 직접 측정하고, 클라이언트가 보낸 값은 절대 믿지 않습니다).

다중 참조 생성이 실제로 뽑아내는 것: 샘플 3편

숫자는 비용을 설명하지만 모델이 콘티대로 움직이는지는 설명하지 못합니다. 참조 파이프라인으로 샘플 3편을 생성했습니다. 입력 소재, 전체 프롬프트(각 모델 페이지에 있습니다), 그리고 무편집 출력을 여기 올립니다. 저희 판독과 대조해 보시면 됩니다.

샘플 1: 제품 이미지 4장에서 나온 30초 원 테이크

들어간 참조 이미지는 정면, 측면 디테일, 충전 케이스, 그리고 비어 있는 디스플레이 세트 4장입니다. 이 편은 재촬영이고, 성공한 두 번째보다 실패한 첫 번째가 더 많은 걸 알려줬습니다. 처음 프롬프트는 타임코드가 붙은 비트를 네 개 적었습니다("6초에 뚜껑이 열린다"). 돌아온 건 죽어 있는 7초의 도입부, 경첩이 아니라 모핑으로 열리는 뚜껑, 그리고 제 형태를 지키지 못하는 제품이었습니다. 프레임 단위로 확인하고 탈락시켰습니다. 고쳐 쓴 프롬프트는 네 개의 비트를, 하나의 연속된 카메라 무브를 공유하는 세 개의 움직임으로 줄이고 형태 변화 금지를 명시했습니다.

참조 이미지 1: 이어버드 정면참조 이미지 2: 이어버드 측면 디테일참조 이미지 3: 충전 케이스참조 이미지 4: 비어 있는 디스플레이 세트

재촬영본을 프레임 단위로 본 결과입니다(2026-08-19). 뚜껑은 실제 경첩을 축으로 들리고 케이스 본체는 움직이지 않습니다. 이어버드는 들리는 순간부터 마지막 프레임까지 같은 형태를 유지하고, 선회와 상승과 후진이 하나의 테이크로 읽힙니다. 죽은 시간도 컷도 없습니다. 실패한 첫 시도에서 가져갈 교훈은 이겁니다. 타임코드가 붙은 비트 목록은 딱딱한 상태 전환을 유발합니다. 움직임 수를 줄이고 하나의 연속된 카메라 무브를 공유시키고 모핑 금지를 명시하는 것, 30초 원 테이크가 버틴 이유는 그것입니다.

샘플 2: 소재 4개로 조립한 캐릭터 한 명

입력은 전신 캐릭터 시트, 얼굴 클로즈업, 재킷 평면 촬영, 그리고 사람이 없는 신전 로케이션 컷입니다. 출력에서는 이 네 가지가 움직임 속에서도 일관돼야 했습니다.

참조 이미지 1: 캐릭터 전신참조 이미지 2: 얼굴 클로즈업참조 이미지 3: 재킷 평면 촬영참조 이미지 4: 신전 로케이션

이 편을 검수하면서 프레임을 넘어 유지된 것은 땋은 머리, 주근깨, 재킷의 버클과 스티치, 그리고 로케이션 판에서 온 아치 광선이었습니다. 대본상 올려다보는 비트는 5초 부근에 떨어집니다. 이건 한 번의 생성이지 일관성 벤치마크가 아닙니다. 한 번의 패스가 무엇을 지켜내는지 보여주는 증거로 올립니다.

샘플 3: 참조 영상에서 옮겨 온 카메라 무브

여기서 참조 세트는 영상 하나(회색 큐브를 180도 도는 밋밋한 아크, 8.2초. 위 메커니즘에 따라 참조 입력 초로 과금됐습니다)와 찻주전자 스틸 한 장입니다. 지시는 이렇습니다. 무브를 복사하고, 피사체를 바꾸고, 나머지는 아무것도 움직이지 마라.

참조 이미지 1: 도자기 찻주전자

출력은 찻주전자 둘레를 일정한 높이로 도는 아크를 유지하고, 속도도 참조본과 비슷합니다. 추가된 움직임은 프롬프트가 요청한 김뿐입니다. 아크는 대본상의 180도로 대략 읽힙니다. 카메라 무브 이식과 피사체 교체는 이 편에서 첫 시도에 성공했습니다.

실측: 지연 시간

텍스트 투 비디오는 각 3회, 이미지 투 비디오는 각 1회. 태스크 생성부터 완료 출력까지의 실제 경과 시간이며 측정일은 2026-08-08입니다.

모델과 모드회차별 결과(초)
Seedance 2.5 텍스트 투 비디오, 경로 A92 / 149 / 187
Seedance 2.5 텍스트 투 비디오, 경로 B132 / 135 / 274
Seedance 2.5 이미지 투 비디오, 경로 A317
Seedance 2.5 이미지 투 비디오, 경로 B149
Seedance 2.0 텍스트 투 비디오약 220(2회)

중앙값보다 편차가 더 중요합니다. 2.5의 최속 기록은 저희가 Seedance 계열에서 측정한 무엇보다 빨랐고, 최저 기록은 그 3배였습니다. 사용자에게 예상 시간을 보여줄 거라면 잘 풀린 경우가 아니라 편차를 기준으로 잡으세요. 경로 A의 317초짜리 이미지 투 비디오는 여러 차례 확인에서도 일관되게 재현돼, 이 모드는 다른 곳으로 보내고 있습니다.

그래도 2.0이 맞는 선택인 경우

정직한 비교라면 이 절이 있어야 합니다.

  • 순수 5초 텍스트 투 비디오: 2.0은 2.5의 실측 최저가의 60% 가격에 뽑아냅니다. 브리프에 참조 소재가 없다면 웃돈으로 사는 게 아무것도 없습니다.
  • 첫 프레임과 마지막 프레임 모프: 2.0의 위치 지정 방식 두 장 이미지 계약은 성숙했고, 6월부터 저희 프로덕션 스모크 테스트를 매번 통과해 왔습니다. 2.5도 참조 목록으로 같은 걸 표현할 수 있지만 더 새로운 경로라 주행거리가 부족합니다.
  • 예측 가능한 지연: 2.0의 측정 2회는 몇 초 차이 안에 들어왔습니다. 2.5의 편차는 2배에서 3배입니다.

이 글의 한계

  • 표본이 작습니다. 텍스트 투 비디오는 경로당 3회, 이미지 투 비디오는 경로당 1회, 과금 실험은 2회입니다. 라우팅 판단용 데이터이지 벤치마크 논문이 아닙니다.
  • 2.5의 비용 수치는 전부 480p, 5초에서 10초 구간에서 측정했습니다. 30초 상한은 아직 측정하지 않았습니다.
  • 가격은 명시한 날짜에 집계형 API 경로가 저희 계정에 청구한 금액입니다. 엔터프라이즈 직계약 가격은 다를 수 있습니다. 공급사는 예고 없이 가격을 바꿉니다.
  • 통제된 화질 비교는 하지 않았습니다. 이 글이 다루는 것은 비용, 지연, 과금 메커니즘처럼 심사위원 없이 측정할 수 있는 범위입니다.

측정 방법

모든 생성은 라우팅 판단에 쓰는 것과 같은 환경을 통과합니다. 각 공급사의 태스크 API에 직접 HTTP를 호출하고, SDK 계층은 끼우지 않으며, 응답 봉투는 원본 그대로 로그에 남깁니다. 비용은 가격표 계산이 아니라 태스크 생성 호출 직전과 직후에 읽은 계정 잔액 차이로 산출합니다. 지연은 태스크 생성부터 완료된 출력을 반환한 첫 폴링까지의 실제 경과 시간입니다. 참조 영상 과금 실험의 절차는 본문에 적었습니다.

두 모델 모두 Vidney에서 가동 중입니다. Seedance 2.5Seedance 2.0입니다. 저희는 각 모드를 그 모드에서 가장 잘 나온 공급사로 보냅니다. 이 데이터가 존재하는 이유가 바로 그것입니다.