ByteDanceSnaptale에서 이용 가능bytedance/seedance-2.5

Seedance 2.5 it speaks now.

ByteDance의 플래그십 영상 모델이자, Snaptale에서 처음으로 스스로 소리를 만들어내는 모델입니다. 대사는 입 모양이 이미 맞춰진 채로 나오고, 최대 30장의 참조 이미지가 캐스트를 붙잡아 주며, 카메라는 여전히 누군가 연출한 것처럼 움직입니다.

자동 라우팅 · 채팅에서 다듬기
take 01 · ambient16:9 · 720p
  • 네이티브 오디오
  • 립싱크 대사
  • 참조 이미지 30장
  • 캐릭터 일관성
  • 멀티샷 장면
  • 9:16 네이티브
  • 16:9 네이티브
  • 720p · 4~15초
02 — 핵심 기능

What it's actually good at, scene by scene.

01네이티브 오디오

소리는 영상 뒤에 붙이는 게 아니라 함께 생성됩니다

대사, 공간음, 효과음이 영상과 같은 패스에서 나오기 때문에 어긋나지 않습니다. 대사를 큰따옴표로 감싸면 캐릭터의 입이 이미 그 말에 맞춰 움직입니다. 별도 TTS도, 수동 싱크도 필요 없습니다.

단일 렌더 · 라이브 클립
·01
·02
·03
02참조 세트

서른 장의 참조, 하나의 일관된 장면

Seedance 2.0은 참조 이미지 아홉 장을 받았습니다. 2.5는 서른 장 — 전체 캐스트, 의상, 제품, 장소를 한 번의 생성에 묶습니다. Snaptale은 @로 언급한 에셋을 프롬프트가 부르는 순서대로 연결합니다.

3프레임 · 동일 피사체
첫 프레임으로 사용된 참조 스틸
첫 프레임 · 스틸
클립 · 실제 렌더링
03이미지에서 영상으로

이미 승인한 스틸에서 시작하세요

어떤 이미지든 첫 프레임으로 고정할 수 있습니다 — GPT Image 2 스틸, 업로드한 사진, 이전 렌더링. 마지막 프레임을 지정해 샷이 어디서 끝날지 정할 수도 있습니다. 같은 에셋이 두 프롬프트에 모두 등장하면 Snaptale이 참조를 자동으로 연결합니다.

첫 프레임 · 스틸 → 클립 · 실제 렌더링
·01
·02
·03
04장면 연출

한 번의 생성 안에서 앵글을 전환합니다

오프닝 와이드, 미디엄 턴, 클로즈를 요청하면 2.5가 같은 렌더링 안에서 전환을 구성합니다 — 오디오도 컷을 가로질러 이어집니다. 다중 피사체 샷에서 지시 이행이 2.0보다 눈에 띄게 정확합니다.

3프레임 · 동일 피사체
16:9 · 가로
9:16 · 세로
05포맷 네이티브

9:16과 16:9로 직접 구도를 잡습니다

포맷을 고르면 모델이 그 포맷에 맞춰 구도를 잡습니다 — 가운데 잘림도, 머리가 화면 밖으로 나가는 일도 없습니다. Snaptale은 2.5를 720p로 렌더링하고, 필요하면 같은 장면을 두 비율로 모두 전달합니다.

16:9 · 가로 → 9:16 · 세로
03 — 작동 방식

Just talk. Snaptale routes.

모델 선택도, 프로바이더 키도, 프롬프트 의식도 필요 없습니다. 샷을 설명하면 에이전트가 적합할 때 Seedance 2.5을 선택하고, 반복하면서 대화 안에 머무를 수 있습니다.

  1. 8초, 그녀가 카메라를 향해 돌아서며 말한다: "돌아왔구나."
    Seedance 2.5 — 샷을 준비하는 중…
    in-thread
    01step / 03

    장면을, 그리고 대사를 쓰세요

    감독처럼 샷을 쓰고, 말하는 대사는 큰따옴표로 감싸세요. Snaptale이 대사를 인식해 클립을 Seedance 2.5에 넣고, 목소리가 영상과 함께 생성되도록 합니다.

  2. bytedance / seedance-2.5렌더링 중 · 9:16 · 720p · 오디오 켜짐
    generation · 720p · audio off
    render
    02step / 03

    Snaptale이 참조를 연결합니다

    @로 언급한 프로젝트 캐릭터, 제품, 스타일 에셋은 모두 라벨이 붙은 참조로 전달됩니다 — 최대 서른 개까지 — 그래서 클립 전체에서 캐스트가 흐트러지지 않습니다.

  3. 비율: → 9:161
    길이: 5 → 8초2
    오디오: 모델 → 프로젝트 BGM3
    refine
    03step / 03

    다시 뽑지 않고 다듬기

    비율을 바꾸고, 길이를 늘리고, 생성된 오디오를 음소거한 뒤 직접 만든 트랙을 얹으세요 — Snaptale은 바뀐 부분만 다시 자르고 타임라인의 나머지는 그대로 둡니다.

05 — Snaptale 안에서

Why run it here.

Seedance 2.5은 훌륭합니다. Snaptale은 그것을 연출 가능하게 만듭니다 — 영속 에셋, 캐릭터 락, 스튜디오와 에이전트가 하나의 프로젝트를 공유.

  • 오디오 · 한 번의 패스로

    애초에 어긋난 적 없는 소리

    오디오가 프레임과 함께 생성되기 때문에, 틀릴 수 있는 싱크 단계 자체가 없습니다. 모델의 트랙을 쓰든, 음소거하고 직접 얹든 — 어느 쪽이든 영상을 다시 렌더링할 필요가 없습니다.

  • 캐스트 · 참조 30장까지

    캐스트 전체를 한 번에 묶기

    참조 이미지 서른 장이면 한 번의 생성에 전체 캐스트와 의상, 장소를 담기에 충분합니다. 일관성은 더 이상 샷마다 싸워서 얻어내는 것이 아닙니다.

  • 라우팅 · 자동

    쓸 때 골라주고, 피해야 할 때 피해줍니다

    Snaptale은 안전하고 스타일화된 작업의 기본값으로 2.5를 쓰고, 포토리얼하거나 유명 IP 중심의 스크립트는 미리 더 관대한 모델로 보냅니다 — 거절된 렌더링 값을 치르고 나서 알 필요가 없습니다.

  • Studio · 대화 안에서

    Studio는 에이전트 바로 옆에 있습니다

    자르고, 다시 편집하고, 음악을 바꾸고, 비율을 바꾸는 일 — 모두 같은 대화 안에서, 방금 생성한 클립에 대해.

06 — FAQ

Quick answers.

01Snaptale에서 Seedance 2.5는 어떤 길이를 지원하나요?

720p에서 클립당 4~15초입니다. 모델 자체는 30초까지 가능하지만, Snaptale은 스크립트 설계와 타임라인 계산의 비교 가능성을 위해 모든 영상 모델을 같은 길이 단계로 맞춥니다. 더 긴 이야기는 클립을 이어 붙이면 되고, 참조 세트가 일관성을 지켜줍니다.

02정말 오디오를 스스로 생성하나요?

네, 2.0에서 바뀐 가장 큰 지점입니다. 대사, 효과음, 배경음악이 영상과 같은 패스에서 나옵니다. 프롬프트에서 말하는 대사를 큰따옴표로 감싸면 모델이 거기에 맞춰 입을 움직입니다. 끄고 Snaptale의 음악·음성 트랙을 쓸 수도 있습니다.

03참조 이미지는 몇 장까지 쓸 수 있나요?

최대 30장 — Snaptale의 모델 중 가장 넓은 참조 세트입니다. 2.0은 9장이었습니다. Snaptale은 @로 언급한 에셋을 프롬프트 순서대로 라벨이 붙은 참조로 전달합니다.

042.5로 기존 클립을 편집하거나 연장할 수 있나요?

아직은 안 됩니다. 영상 편집과 연장은 Seedance 2.0에서 동작합니다. 그쪽은 렌더링이 시작되기 전에 출력 길이 — 곧 가격 — 를 확정할 수 있기 때문입니다. 2.5에서는 편집된 클립의 길이를 공급자가 직접 정하고 초당 요율도 약 네 배라, 의도적으로 이 경로에서 빼두었습니다.

05출력 해상도는 어떻게 되나요?

720p입니다. 2.0과 달리 이 모델에는 저희 공급자에서 1080p나 4K 단계가 없습니다. Snaptale의 내보내기가 가벼운 패스로 1080p로 업샘플해 전달합니다.

06Snaptale은 Seedance 2.5와 다른 모델을 어떻게 고르나요?

2.5는 안전하고 분명히 스타일화되었거나 가상인 작업의 기본값입니다. 포토리얼하게 읽히거나 실존 유명 IP·공인을 중심에 둔 스크립트는 미리 Happy Horse 1.1로 보냅니다 — Seedance 계열의 콘텐츠 검수가 그런 내용을 거절하는 경향이 있고, 미리 바꾸는 편이 거절된 렌더링보다 저렴하기 때문입니다.