Seedance 2.0 Reference: Multi-Modal AI-video från bilder, video och ljud
Seedance 2.0 Reference är den enda Seedance-varianten som accepterar upp till 9 bilder, 3 videoklipp och 3 ljudklipp som stilreferenser. Här är hur det förändrar spelet för konsekvent AI-video.

Nio bilder. Tre videor. Tre ljudklipp. En AI-videogenerering. Det är det unika försäljningsargumentet för Seedance 2.0 Reference, och det är den enda modellen i Seedance-serien som behandlar stil som en förstklassig inmatning istället för en efterkonstruerad promptidé.
Om du någonsin har försökt upprätthålla ett konsekvent utseende över en batch AI-videor vet du hur det smärtar. Vanliga text-till-video-modeller tolkar "cinematisk", "dyster" och "varm filmkorn" på samma sätt som en uttråkad praktikant tolkar ett uppdrag. Seedance 2.0 Reference hoppar över tolkningen och tittar direkt på det arbete du vill efterlikna.
TLDR
- Accepterar upp till 9 referensbilder, 3 referensvideor och 3 ljudklipp per generering
- Prissättning: $0.3024 per sekund → ungefär 243 till 907 krediter ($2.42 till $9.07) per klipp
- Utmatning: 720p, 4-15 sekunder varaktighet, inbyggd ljudsynkronisering
- Genereringstid: 60-180 sekunder beroende på klipplängd
- Den enda Seedance-varianten byggd för flermanuell stilöverföring
- Prova det gratis med 50 krediter, inget kort krävs på arteza.ai
Vad "Multi-Modal Reference" faktiskt betyder
De flesta AI-videomodeller accepterar en av två saker: en prompt, eller en prompt plus en enskild startbild. Seedance 2.0 Reference accepterar en hel moodboards värd av inmatningar och behandlar dem som ett enhetligt stiluppdrag.
Ladda upp nio bilder från en cyberpunk-film och den matchar färggradationen, linsfölelsen och neon-på-våt-asfalt-belysningen. Lägg till ett kort klipp som har den exakta kamerarörelse du vill ha. Släpp ett ljudreferens för skummets känsla. Modellen sammanfogar allt.
Det här spelar roll eftersom stil är flerdimensionell. En "retro 80-tal"-look är inte en sak - det är korn, färgtemperatur, linsfläckar, filmgrind-väv och specifika sammansättningar. Att beskriva det med ord förlorar information. Att visa det med 9 bilder förlorar nästan ingen.

Redo att matcha din egen visuella stil? Seedance 2.0 Reference accepterar din hela moodboard i en enda generering. Prova gratis med 50 credits.
5 gratis generationer · Inget kreditkort krävs
Inmatningarna förklarade
Referensbilder (upp till 9). Hjärtat i modellen. Använd dessa för att låsa in färgpalett, belysningsstil, motivutseende, sammansättningsregler och textur. Fler referenser betyder generellt sett straffar stilöverensstämmelse. Nio är gränsen eftersom bortom det börjar fusionen genomsnitt ut din avsikt.
Referensvideor (upp till 3). Använd dessa för rörelseledtrådar - kamerarörelser, tempo, handlingsslag. Modellen samplar rörelsevektor från referenserna och blandar dem in i utgången. En handhållen referens plus en dolly-referens ger dig något däremellan.
Referensljud (upp till 3). Mindre om själva ljudet och mer om det humör det antyder. Omgivande referenserna vägleder den visuella atmosfären - ett stormigt ljudspår kommer att knuffa genereringen mot stormigare visuella element även om du inte specificerade väder.
Textprompt. Fortfarande krävs. Referenser säger till modellen hur; prompten säger den vad.
Hur det jämförs med standard Seedance 2.0
Standard Seedance 2.0 är en text-till-video och bild-till-video powerhouse. Den accepterar en prompt och eventuellt en bild. Det är det. Reference-varianten är samma underliggande modell med en drastiskt utökad inmatningsyta.
| Funktion | Seedance 2.0 | Seedance 2.0 Reference |
|---|---|---|
| Textprompt | Ja | Ja |
| Bidinmatning | 1 bild | Upp till 9 bilder |
| Videoreferens | Nej | Upp till 3 videor |
| Ljudreferens | Nej | Upp till 3 ljudklipp |
| Kostnad per sekund | $0.3034 | $0.3024 |
| Bäst för | Snabb generering från en prompt | Stilkonsekventa serier, varumärkessvideor, lookbooks |
Priserna per sekund är nästan identiska. Det som ändras är vad du kan mata modellen med - och vad som olåses.
Prissättning: Vad du faktiskt betalar
Seedance 2.0 Reference faktureras på $0.3024 per sekund av utgången. Det bryter ned rent:
| Varaktighet | Krediter | USD |
|---|---|---|
| 4 sekunder | 243 | $2.42 |
| 5 sekunder | 303 | $3.02 |
| 8 sekunder | 484 | $4.84 |
| 10 sekunder | 605 | $6.05 |
| 15 sekunder | 907 | $9.07 |
Referenserna själva är gratis. Du betalar för utmatningsvaraktighet, inte inmatningsantal. Nio bilder kostar samma som en.
Nya konton får 50 gratis krediter vid registrering, prisvärda prenumerationsplaner, inget kort. Det räcker till att köra ditt första referensmodtest. Därifrån fyller du på den nivå som passar:
| Kreditpaket | Pris | Krediter |
|---|---|---|
| Starter | $10 | 1,050 |
| Populär | $25 | 2,750 |
| Pro | $50 | 5,750 |
| Max | $100 | 12,000 |
Se den fullständiga uppdelningen på priser.
Prova Seedance 2.0 Reference - flermanuell videogenerering
Matcha din visuella stil med upp till 9 bildreferenser. 50 gratis krediter, inget kort krävs.
Prova Seedance 2.0 Reference gratisDär Reference Mode tjänar sitt värde
Varumärkessvideor. Ladda upp din produktfotografi, din befintliga annonskreativitet, dina varumärkesfarger. Utgången matchar din visuella identitet utan att du behöver beskriva det.
Videoserier med konsekvent stil. Filmar du en 10-delad sekvens? Använd samma referenspaket på varje generering och bitarna kommer att kännas som de kom från ett skjutande.
Lookbooks och mode. Reference mode är exceptionell på att matcha en fotografistil - studioblixtering, linskompression, garderobsfärg - över flera modeller och poser.
Storyboard-till-video. Mata modellen med din konceptkonst och få rörliga versioner i samma stil. Ingen mer "nästan bra nog" kompromiss.
Musikvideopreviz. Ljudreferenser plus visuella referenser plus en prompt motsvarar en råklipper som faktiskt återspeglar sångens känsla.
Utgången: Vad du får
Varje Seedance 2.0 Reference-generering producerar:
- 720p-video vid 24 fps
- 4 till 15 sekunder av varaktighet (du väljer)
- Inbyggd ljudsynkronisering - omgivande ljud genererat för att matcha scenen
- Tre bildförhållanden: 16:9, 9:16, 1:1
- Leverans på 60 till 180 sekunder beroende på längd
Det inbyggda ljudet är värt att betona. Även utan ljudreferenser får du foley-stil omgivning inbyggd. Med ljudreferenser får du omgivning som matchar ditt humörkort.
Prompt + Reference: Det hybrida arbetsflödet
Misstaget som människor gör är att luta sig helt på referenser och skriva ett lata prompt. Referenser hanterar stil. Prompten måste fortfarande göra det tunga lyftet på ämne, åtgärd och sammansättning.
En bra hybridprompt ser ut så här:
En kvinna i en röd trenchcoat som går genom en regnvåt Tokyo-gränd
näkter, neonskyltningar reflekteras i vattenpölar, långsam dolly framåt, handhållen
känsla, cinematisk
Med 6 cyberpunk-referensbilder bifogade vet modellen vad "cinematisk" betyder för denna skjutning. Det behöver inte gissa.
Hur Seedance 2.0 Reference passar in i ByteDance-familjen
Om du har följt ByteDances AI-videoreleaser vet du att det finns en hel familj nu: Seedance 1.0 Pro, Seedance 2.0, Seedream för stillbilder och OmniHuman-avatarraden.
Seedance 2.0 Reference är det nyaste stycket och det mest specialiserade. Det är inte menat att ersätta standard Seedance 2.0 - för engångsklipp från en prompt är standard snabbare och billigare att iterera på. Reference-läget är för när du behöver din utgång för att matcha något.
Komma igång på under fem minuter
- Gå till arteza.ai/create/seedance-2-reference
- Logga in (50 gratis krediter tillämpas automatiskt)
- Ladda upp 3-9 referensbilder som representerar din målstil
- Lägg eventuellt till 1-3 referensvideor för rörelse och 1-3 ljudklipp för humör
- Skriv din prompt som beskriver motivet och åtgärden
- Välj en varaktighet (5 sekunder är ett bra första test)
- Generera
Ditt första klipp laddas ned på cirka 90 sekunder.
De ärliga begränsningarna
Reference-läget är inte magi. Om dina 9 referenser motsäger varandra - hälften dyster skräck, hälften ljus komedi - kommer modellen att genomsnitt dem och du får något fadligt. Kurera tätt.
Den kan inte heller generera original dialog eller musik. Ljudsynkroniseringen är omgivande och foley. För läpp-synkade pratande huvuden vill du OmniHuman istället.
Och medan modellen är stark på stilöverföring är det inte ett perfekt ansiktsväxlingsverktyg. Att använda referensbilder av en specifik person kommer att fånga deras allmänna utseende men inte deras exakta likhet. Det är en funktion, inte en bug.
Nästa steg
Om du vill ha steg-för-steg-handledning för din första generering, läs vår stilkonsekvent videovägledning. Om du väljer mellan varianter bryter Reference vs Standard-jämförelsen det ner. Och om du kommer från en annan plattform täcker Reference vs Runway-delen växlingen.
Seedance 2.0 Reference är den första AI-videomodellen som behandlar din visuella stil som inmatning snarare än tolkning. Prova den med dina egna referenser och se vad som händer.
Din moodboard, din video
Ladda upp upp till 9 bilder, 3 videor och 3 ljudklipp. Få en matchande AI-video på mindre än 3 minuter.
Börja skapa gratisTry Seedance 2.0 - Right Now
5 free generations · No credit card needed