Seedance 2.0 Reference: Video AI Multi-Modale da Immagini, Video e Audio
Seedance 2.0 Reference è l'unica variante Seedance che accetta fino a 9 immagini, 3 video e 3 clip audio come riferimenti di stile. Ecco come cambia il gioco per i video AI coerenti.

Nove immagini. Tre video. Tre clip audio. Una generazione video AI. Questo è l'unico pitch per Seedance 2.0 Reference, ed è l'unico modello della linea Seedance che tratta lo stile come input di prima classe invece di un'idea secondaria nel prompt.
Se hai mai provato a mantenere un look coerente su un lotto di video AI, conosci il dolore. I modelli standard di text-to-video interpretano "cinematografico", "malinconico" e "grana film calda" come un tirocinante annoiato interpreta un briefing. Seedance 2.0 Reference salta l'interpretazione e guarda direttamente il lavoro che vuoi emulare.
TL;DR
- Accetta fino a 9 immagini di riferimento, 3 video di riferimento e 3 clip audio per generazione
- Prezzi: 0,3024 dollari al secondo → circa 243 a 907 crediti (2,42 a 9,07 dollari) per clip
- Output: 720p, durata 4-15 secondi, sincronizzazione audio nativa integrata
- Tempo di generazione: 60-180 secondi a seconda della lunghezza della clip
- L'unica variante Seedance costruita per il trasferimento di stile multi-modale
- Provala gratis con 50 crediti, nessuna carta richiesta su arteza.ai
Cosa significa veramente "Riferimento Multi-Modale"
La maggior parte dei modelli video AI accetta una di due cose: un prompt, oppure un prompt più una singola immagine iniziale. Seedance 2.0 Reference accetta un'intera moodboard di input e li tratta come un brief di stile unificato.
Carica nove fotogrammi da un film cyberpunk e abbinerà il color grade, l'aspetto dell'obiettivo e l'illuminazione neon-su-asfalto-bagnato. Aggiungi una clip breve che ha esattamente il movimento di camera che desideri. Inserisci un riferimento audio per l'atmosfera della colonna sonora. Il modello fonde tutto.
Questo è importante perché lo stile è multidimensionale. Un look "retro anni 80" non è una sola cosa: è grana, temperatura del colore, riflessi di obiettivo, weave della gate film e composizioni specifiche. Descriverlo a parole perde informazioni. Mostrarlo con 9 immagini perde quasi nulla.

Pronto ad abbinare il tuo stile visivo? Seedance 2.0 Reference accetta l'intera tua moodboard in una singola generazione. Prova gratuitamente con 50 crediti.
5 generazioni gratuite · Nessuna carta di credito richiesta
Gli Input, Spiegati
Immagini di riferimento (fino a 9). Il cuore del modello. Usale per bloccare la tavolozza dei colori, lo stile di illuminazione, l'aspetto del soggetto, le regole di composizione e la texture. Più riferimenti generalmente significano un'aderenza allo stile più stretta. Nove è il massimo perché oltre questo, la fusione inizia a fare la media della tua intenzione.
Video di riferimento (fino a 3). Usali per suggerimenti di movimento: movimenti di camera, ritmo, beat d'azione. Il modello campiona i vettori di movimento dai riferimenti e li fonde nell'output. Un riferimento handheld più un riferimento dolly ti daranno qualcosa di mezzo.
Audio di riferimento (fino a 3). Meno riguardante il suono stesso e più riguardante l'atmosfera che implica. I riferimenti ambientali guidano l'atmosfera visiva: una traccia audio tempestosa spingerà la generazione verso visivi più tempestosi anche se non hai specificato il meteo.
Prompt di testo. Ancora richiesto. I riferimenti dicono al modello come; il prompt gli dice cosa.
Come si Confronta con lo Standard Seedance 2.0
Lo standard Seedance 2.0 è una bestia da lavoro text-to-video e image-to-video. Accetta un prompt e opzionalmente un'immagine. È tutto. La variante Reference è lo stesso modello sottostante con una superficie di input drasticamente espansa.
| Funzionalità | Seedance 2.0 | Seedance 2.0 Reference |
|---|---|---|
| Prompt di testo | Sì | Sì |
| Input immagine | 1 immagine | Fino a 9 immagini |
| Riferimento video | No | Fino a 3 video |
| Riferimento audio | No | Fino a 3 clip audio |
| Costo al secondo | 0,3034 dollari | 0,3024 dollari |
| Migliore per | Generazione veloce da un prompt | Serie coerente per stile, video di brand, lookbook |
Il prezzo al secondo è quasi identico. Quello che cambia è ciò che puoi fornire al modello e ciò che sblocca.
Prezzi: Quello che Pagherai Davvero
Seedance 2.0 Reference addebita a 0,3024 dollari al secondo di output. Si divide chiaramente:
| Durata | Crediti | USD |
|---|---|---|
| 4 secondi | 243 | 2,42 |
| 5 secondi | 303 | 3,02 |
| 8 secondi | 484 | 4,84 |
| 10 secondi | 605 | 6,05 |
| 15 secondi | 907 | 9,07 |
I riferimenti stessi sono gratuiti. Paghi per la durata dell'output, non per il numero di input. Nove immagini costano quanto una.
I nuovi account ricevono 50 crediti gratuiti alla registrazione, piani di abbonamento convenienti, nessuna carta. È abbastanza per eseguire il tuo primo test in modalità di riferimento. Da lì, rinnovi il livello che ti si adatta:
| Pacchetto di Crediti | Prezzo | Crediti |
|---|---|---|
| Starter | 10 dollari | 1.050 |
| Popolare | 25 dollari | 2.750 |
| Pro | 50 dollari | 5.750 |
| Max | 100 dollari | 12.000 |
Vedi il breakdown completo su prezzi.
Prova Seedance 2.0 Reference - generazione video multi-modale
Abbina il tuo stile visivo con fino a 9 riferimenti di immagine. 50 crediti gratuiti, nessuna carta richiesta.
Prova Seedance 2.0 Reference GratisDove la Modalità di Riferimento Guadagna il Suo Posto
Video di brand. Carica la tua fotografia di prodotto, il tuo creative pubblicitario esistente, i tuoi colori di brand. L'output abbina l'identità visiva senza che tu debba descriverla.
Serie video con stile coerente. Stai girando una sequenza di 10 parti? Usa lo stesso bundle di riferimento su ogni generazione e i pezzi sembreranno venire dallo stesso set.
Lookbook e moda. La modalità di riferimento è eccezionale nell'abbinare uno stile fotografico - illuminazione in studio, compressione dell'obiettivo, colore del guardaroba - su più modelli e pose.
Da storyboard a video. Fornisci al modello il tuo concept art e ottieni versioni in movimento nello stesso stile. Niente più compromessi "abbastanza vicino".
Pre-viz video musicale. Riferimenti audio più riferimenti visivi più un prompt equivale a un rough cut che riflette davvero l'atmosfera della canzone.
L'Output: Quello Che Ottieni
Ogni generazione Seedance 2.0 Reference produce:
- Video 720p a 24 fps
- 4 a 15 secondi di durata (scegli tu)
- Sincronizzazione audio nativa - audio ambientale generato per abbinare la scena
- Tre proporzioni: 16:9, 9:16, 1:1
- Consegna in 60 a 180 secondi a seconda della lunghezza
L'audio nativo merita di essere enfatizzato. Anche senza riferimenti audio, ottieni ambientazione in stile foley integrata. Con riferimenti audio, ottieni ambientazione che abbina il tuo suggerimento di mood.
Prompt + Riferimento: Il Flusso di Lavoro Ibrido
L'errore che fanno le persone è appoggiarsi interamente ai riferimenti e scrivere un prompt pigro. I riferimenti gestiscono lo stile. Il prompt deve ancora fare il lavoro pesante su soggetto, azione e composizione.
Un buon prompt ibrido è così:
Una donna in un trench coat rosso che cammina attraverso un vicolo di Tokyo
bagnato dalla pioggia di notte, insegne al neon riflesse nelle pozzanghere,
movimento dolly lento, atmosfera handheld, cinematografico
Con 6 immagini di riferimento cyberpunk allegate, il modello sa cosa significa "cinematografico" per questo set. Non deve indovinare.
Come Seedance 2.0 Reference si Inserisce nella Linea ByteDance
Se hai seguito i rilasci di video AI di ByteDance, sai che c'è un'intera famiglia ora: Seedance 1.0 Pro, Seedance 2.0, Seedream per immagini fisse, e la linea avatar OmniHuman.
Seedance 2.0 Reference è il pezzo più nuovo e il più specializzato. Non è inteso a sostituire lo standard Seedance 2.0 - per clip una tantum da un prompt, lo standard è più veloce e più economico per iterare. La modalità di riferimento è per quando hai bisogno che il tuo output corrisponda a qualcosa.
Iniziare in Meno di Cinque Minuti
- Vai a arteza.ai/create/seedance-2-reference
- Accedi (50 crediti gratuiti si applicano automaticamente)
- Carica 3-9 immagini di riferimento che rappresentano il tuo stile target
- Opzionalmente aggiungi 1-3 video di riferimento per il movimento e 1-3 clip audio per l'atmosfera
- Scrivi il tuo prompt descrivendo il soggetto e l'azione
- Scegli una durata (5 secondi è un buon primo test)
- Genera
Il tuo primo clip viene scaricato in circa 90 secondi.
Le Limitazioni Oneste
La modalità di riferimento non è magia. Se i tuoi 9 riferimenti si contraddicono a vicenda - metà horror cupo, metà commedia brillante - il modello farà la media e otterrai qualcosa di noioso. Cura strettamente.
Inoltre non può generare dialogo originale o musica. La sincronizzazione audio è ambientale e foley. Per parlare persone con sincronizzazione labiale preferisci OmniHuman invece.
E anche se il modello è forte nel trasferimento di stile, non è uno strumento di scambio di volti perfetto. Usare immagini di riferimento di una persona specifica catturerà il loro aspetto generale ma non la loro esatta somiglianza. È una funzionalità, non un bug.
Prossimi Passi
Se desideri il tutorial pratico per la tua prima generazione, leggi il nostro guida video coerente nello stile. Se stai decidendo tra le varianti, il confronto Reference vs Standard lo spiega. E se stai venendo da un'altra piattaforma, il pezzo Reference vs Runway copre il cambio.
Seedance 2.0 Reference è il primo modello di video AI che tratta il tuo stile visivo come input piuttosto che interpretazione. Provalo con i tuoi riferimenti e vedi cosa succede.
La tua moodboard, il tuo video
Carica fino a 9 immagini, 3 video e 3 clip audio. Ottieni un video AI corrispondente in meno di 3 minuti.
Inizia a Creare GratisTry Seedance 2.0 - Right Now
5 free generations · No credit card needed