Seedance 2.0 Reference: multimodal AI-video från bilder, video och ljud
Seedance 2.0 Reference är den enda Seedance-varianten som accepterar upp till 9 bilder, 3 videor och 3 ljudklipp som stilreferenser. Så här förändrar den spelet för konsekvent AI-video.

Nio bilder. Tre videor. Tre ljudklipp. En AI-videogenerering. Det är det unika erbjudandet med Seedance 2.0 Reference, och det är den enda modellen i Seedance-familjen som behandlar stil som ett förstklassigt indata snarare än ett efterhanksgrepp i prompten.
Om du någonsin har försökt hålla en konsekvent look över en batch AI-videor vet du hur frustrerande det kan vara. Vanliga text-till-video-modeller tolkar "cinematic", "stämningsfullt" och "varm filmkornighet" ungefär som en ointresserad praktikant tolkar en brief. Seedance 2.0 Reference hoppar över tolkningen och tittar direkt på det arbete du vill efterlikna.
TL;DR
- Accepterar upp till 9 referensbilder, 3 referensvideor och 3 ljudklipp per generering
- Pris: $0,3024 per sekund → 19-154 credits ($1,90-$15,40) per klipp
- Utdata: 720p, 4-15 sekunders duration, inbyggd native-ljudsynk
- Genereringstid: 60-180 sekunder beroende på klipplängd
- Den enda Seedance-varianten byggd för multimodal stilöverföring
- Prova gratis med 10 credits, inget kort krävs på arteza.ai
Vad "multimodal referens" faktiskt innebär
De flesta AI-videomodeller accepterar en av två saker: en prompt, eller en prompt plus en enda startbild. Seedance 2.0 Reference accepterar ett helt moodboards värde av indata och behandlar dem som en gemensam stilbriefing.
Ladda upp nio stillbilder från en cyberpunkfilm så matchar den färggraderingen, linsens känsla och neonljuset-mot-vått-asfalt-belysningen. Lägg till ett kort klipp med exakt den kamerarörelse du vill ha. Droppa in en ljudreferens för stämningen i musiken. Modellen smälter samman allt.
Det här spelar roll eftersom stil är flerdimensionell. En "retro 80-tals" look är inte en enda sak, det är filmkorn, färgtemperatur, linsreflexer, filmkant-rörelse och specifika kompositioner. Att beskriva det i ord tappar information. Att visa det med 9 bilder tappar nästan ingenting.

Redo att matcha din egen visuella stil? Seedance 2.0 Reference accepterar hela ditt moodboard i en enda generering. Prova gratis med 10 krediter.
5 gratis generationer · Inget kreditkort krävs
Indatan förklarad
Referensbilder (upp till 9). Modellens hjärta. Använd dem för att låsa in färgpalett, belysningsstil, motivets utseende, kompositionsregler och textur. Fler referenser ger i allmänhet tätare stilanpassning. Nio är taket eftersom sammanslagningen börjar medelvärdesberäkna din avsikt om du går längre.
Referensvideor (upp till 3). Använd dessa för rörelsesignaler, kamerarörelser, tempo och actionbeats. Modellen samplar rörelsevektorer från referenserna och blandar dem i utdatan. En handhållen referens plus en dolly-referens ger dig något däremellan.
Referensljud (upp till 3). Handlar mindre om själva ljudet och mer om den stämning det antyder. Ambient-referenser styr den visuella atmosfären, ett stormigt ljudspår nudgar genereringen mot stormigare bilder även om du inte angav väder.
Textprompt. Fortfarande obligatorisk. Referenserna berättar för modellen hur; prompten berättar vad.
Hur det jämförs med standard Seedance 2.0
Standard Seedance 2.0 är ett text-till-video- och bild-till-video-arbetshäst. Den accepterar en prompt och valfritt en bild. Det är allt. Reference-varianten är samma underliggande modell med en drastiskt utökad indatayta.
| Funktion | Seedance 2.0 | Seedance 2.0 Reference |
|---|---|---|
| Textprompt | Ja | Ja |
| Bildindata | 1 bild | Upp till 9 bilder |
| Videoreferens | Nej | Upp till 3 videor |
| Ljudreferens | Nej | Upp till 3 ljudklipp |
| Kostnad per sekund | $0.3034 | $0.3024 |
| Bäst för | Snabb generering från en prompt | Stilkonsekvent serie, varumärkesvideor, lookbooks |
Priset per sekund är nästan identiskt. Det som förändras är vad du kan mata modellen med, och vad det möjliggör.
Pris: vad du faktiskt betalar
Seedance 2.0 Reference faktureras till ungefär 2,9 credits per sekund av utdata. Det bryts ned tydligt:
| Duration | Credits | USD |
|---|---|---|
| 4 sekunder | 19 | $1.90 |
| 5 sekunder | 23 | $2.30 |
| 8 sekunder | 37 | $3.70 |
| 10 sekunder | 46 | $4.60 |
| 15 sekunder | 69 | $6.90 |
Referenserna i sig är gratis. Du betalar för utdatans duration, inte antalet indata. Nio bilder kostar lika mycket som en.
Nya konton får 10 gratis credits vid registrering, inget kort krävs, inget årsavtal. Det räcker för att köra ditt första test i referensläge. Därifrån väljer du den månadsplan som passar:
| Plan | Pris | Månadsliga credits |
|---|---|---|
| Starter | $5 | 60 |
| Creator | $25 | 300 |
| Pro | $50 | 700 |
| Studio | $120 | 1 800 |
Se den fullständiga översikten på priser.
Prova Seedance 2.0 Reference - multimodal videogenerering
Matcha din visuella stil med upp till 9 bildreferenser. Gratis credits, inget kort krävs.
Prova Seedance 2.0 Reference gratisDär referensläget verkligen gör skillnad
Varumärkesvideor. Ladda upp din produktfotografi, ditt befintliga annonskreativ och dina varumärkesfärger. Utdatan matchar din visuella identitet utan att du behöver beskriva den.
Videoserier med konsekvent stil. Spelar du in en 10-delars sekvens? Använd samma referenspaket på varje generering så känns delarna som att de kom från samma inspelning.
Lookbooks och mode. Referensläget är exceptionellt bra på att matcha en fotografisk stil, studiobelysning, linskompression och garderobers färger, över flera modeller och poser.
Storyboard till video. Mata modellen med ditt konceptkonstverk och få rörliga versioner i samma stil. Inga fler "ungefär rätt"-kompromisser.
Musikvideo-pre-viz. Ljudreferenser plus visuella referenser plus en prompt är lika med ett råklipp som faktiskt återspeglar låtens stämning.
Utdatan: vad du får
Varje Seedance 2.0 Reference-generering producerar:
- 720p-video i 24 fps
- 4 till 15 sekunder duration (du väljer)
- Native-ljudsynk, ambient-ljud genererat för att matcha scenen
- Tre bildformat: 16:9, 9:16, 1:1
- Leverans på 60 till 180 sekunder beroende på längd
Det inbyggda ljudet är värt att betona. Även utan ljudreferenser får du foley-liknande ambient-ljud inbakat. Med ljudreferenser får du ambient-ljud som matchar din stämningssignal.
Prompt och referens: det hybrida arbetsflödet
Misstaget folk gör är att luta sig helt på referenserna och skriva en lat prompt. Referenserna hanterar stilen. Prompten måste fortfarande göra det tunga lyftet vad gäller motiv, handling och komposition.
En bra hybridprompt ser ut så här:
A woman in a red trench coat walking through a rain-soaked Tokyo alley
at night, neon signs reflecting in puddles, slow dolly forward, handheld
feel, cinematic
Med 6 cyberpunk-referensbilder bifogade vet modellen vad "cinematic" betyder för den här inspelningen. Den behöver inte gissa.
Hur Seedance 2.0 Reference passar in i ByteDance-familjen
Om du har följt ByteDances AI-videosläpp vet du att det finns en hel familj nu: Seedance 1.0 Pro, Seedance 2.0, Seedream för stillbilder och OmniHuman-avatarlinjen.
Seedance 2.0 Reference är den nyaste delen och den mest specialiserade. Den är inte tänkt att ersätta standard Seedance 2.0, för engångsklipp från en prompt är standardversionen snabbare och billigare att iterera med. Referensläget är till för när du behöver att ditt resultat matchar något.
Kom igång på under fem minuter
- Gå till arteza.ai/create/seedance-2-reference
- Logga in (10 gratis credits appliceras automatiskt)
- Ladda upp 3-9 referensbilder som representerar din målstil
- Lägg valfritt till 1-3 referensvideor för rörelse och 1-3 ljudklipp för stämning
- Skriv din prompt som beskriver motivet och handlingen
- Välj en duration (5 sekunder är ett bra första test)
- Generera
Ditt första klipp laddas ned på ungefär 90 sekunder.
De ärliga begränsningarna
Referensläget är ingen magi. Om dina 9 referenser motsäger varandra, hälften dyster skräck och hälften ljus komedi, kommer modellen att medelvärdesberäkna dem och du får något intetsägande. Kurera noggrant.
Det kan heller inte generera originaldialoger eller musik. Ljudsynken är ambient och foley. För läppsynkade pratande huvuden vill du ha OmniHuman istället.
Och även om modellen är stark på stilöverföring är den inte ett perfekt ansikte-swap-verktyg. Att använda referensbilder på en specifik person fångar deras allmänna utseende men inte deras exakta likhet. Det är en funktion, inte en bugg.
Nästa steg
Om du vill ha den praktiska handledningen för din första generering, läs vår guide för stilkonsekvent video. Om du bestämmer dig mellan varianter bryter Reference vs Standard-jämförelsen ned det. Och om du kommer från en annan plattform täcker Reference vs Runway-artikeln bytet.
Seedance 2.0 Reference är den första AI-videomodellen som behandlar din visuella stil som indata snarare än tolkning. Prova den med dina egna referenser och se vad som händer.
Ditt moodboard, din video
Ladda upp upp till 9 bilder, 3 videor och 3 ljudklipp. Få en matchande AI-video på under 3 minuter.
Börja skapa gratisProva Seedance 2.0 - Just nu
5 gratis generationer · Inget kreditkort krävs