Seedance 2.0 Reference: video AI multimodale da immagini, video e audio
Seedance 2.0 Reference è l'unica variante di Seedance che accetta fino a 9 immagini, 3 video e 3 clip audio come riferimenti di stile. Ecco come cambia le regole del gioco per i video AI coerenti.

Nove immagini. Tre video. Tre clip audio. Una sola generazione video AI. Questa è la proposta unica di Seedance 2.0 Reference, l'unico modello della lineup Seedance che tratta lo stile come un input di primo livello anziché come un ripensamento del prompt.
Se hai mai cercato di mantenere un look coerente su un batch di video AI, conosci bene il problema. I modelli standard text-to-video interpretano "cinematografico", "malinconico" e "grana della pellicola calda" come un tirocinante annoiato interpreta un brief. Seedance 2.0 Reference salta l'interpretazione e guarda direttamente al lavoro che vuoi emulare.
TL;DR
- Accetta fino a 9 immagini di riferimento, 3 video di riferimento e 3 clip audio per generazione
- Prezzo: $0,3024 al secondo → 19-154 crediti ($1,90-$15,40) per clip
- Output: 720p, durata da 4 a 15 secondi, sincronizzazione audio nativa integrata
- Tempo di generazione: 60-180 secondi in base alla lunghezza della clip
- L'unica variante Seedance progettata per il trasferimento di stile multimodale
- Provalo gratis con 10 crediti, senza carta richiesta su arteza.ai
Cosa significa davvero "riferimento multimodale"
La maggior parte dei modelli video AI accetta una di due cose: un prompt, oppure un prompt più una singola immagine di partenza. Seedance 2.0 Reference accetta un intero moodboard di input e li tratta come un brief stilistico unificato.
Carica nove fotogrammi da un film cyberpunk e abbinerà la correzione del colore, la sensazione dell'ottica e le luci al neon riflesse sull'asfalto bagnato. Aggiungi una clip breve con il movimento di macchina esatto che desideri. Inserisci un riferimento audio per l'atmosfera della colonna sonora. Il modello fonde tutto insieme.
Questo è importante perché lo stile è multidimensionale. Un look "retro anni '80" non è una cosa sola: è grana, temperatura del colore, lens flare, variazione del gate della pellicola e composizioni specifiche. Descriverlo a parole fa perdere informazioni. Mostrarlo con 9 immagini ne perde quasi nessuna.

Pronto a riprodurre il tuo stile visivo? Seedance 2.0 Reference accetta il tuo intero moodboard in una singola generazione. Provalo gratis con 10 crediti.
5 generazioni gratuite · Nessuna carta di credito richiesta
Gli input, spiegati
Immagini di riferimento (fino a 9). Il cuore del modello. Usale per definire palette di colori, stile di illuminazione, aspetto dei soggetti, regole di composizione e texture. Più riferimenti significano generalmente una maggiore aderenza allo stile. Nove è il limite massimo perché oltre quella soglia la fusione inizia ad appiattire le tue intenzioni.
Video di riferimento (fino a 3). Usali come indicazioni di movimento: movimenti di macchina, ritmo, battute d'azione. Il modello campiona i vettori di movimento dai riferimenti e li integra nell'output. Un riferimento a mano libera più un riferimento con carrello ti darà qualcosa nel mezzo.
Audio di riferimento (fino a 3). Meno legato al suono in sé e più all'atmosfera che implica. I riferimenti ambientali guidano l'atmosfera visiva: una traccia audio tempestosa spingerà la generazione verso immagini più cupe anche se non hai specificato il meteo.
Prompt testuale. Ancora obbligatorio. I riferimenti dicono al modello come; il prompt gli dice cosa.
Come si confronta con Seedance 2.0 standard
Il modello Seedance 2.0 standard è un punto di riferimento per il text-to-video e l'image-to-video. Accetta un prompt e facoltativamente un'immagine. Stop. La variante Reference è lo stesso modello di base con una superficie di input drasticamente ampliata.
| Funzione | Seedance 2.0 | Seedance 2.0 Reference |
|---|---|---|
| Prompt testuale | Sì | Sì |
| Input immagine | 1 immagine | Fino a 9 immagini |
| Riferimento video | No | Fino a 3 video |
| Riferimento audio | No | Fino a 3 clip audio |
| Costo al secondo | $0,3034 | $0,3024 |
| Ideale per | Generazione rapida da prompt | Serie con stile coerente, video brand, lookbook |
Il prezzo al secondo è quasi identico. Ciò che cambia è ciò che puoi fornire al modello e cosa questo sblocca.
Prezzi: quanto pagherai davvero
Seedance 2.0 Reference viene fatturato a circa 2,9 crediti al secondo di output. La suddivisione è semplice:
| Durata | Crediti | USD |
|---|---|---|
| 4 secondi | 19 | $1,90 |
| 5 secondi | 23 | $2,30 |
| 8 secondi | 37 | $3,70 |
| 10 secondi | 46 | $4,60 |
| 15 secondi | 69 | $6,90 |
I riferimenti stessi sono gratuiti. Paghi per la durata dell'output, non per il numero degli input. Nove immagini costano quanto una.
I nuovi account ricevono 10 crediti gratuiti alla registrazione, senza carta e senza contratto annuale. Sono sufficienti per eseguire il primo test in modalità reference. Da lì, scegli il piano mensile più adatto:
| Piano | Prezzo | Crediti mensili |
|---|---|---|
| Starter | $5 | 60 |
| Creator | $25 | 300 |
| Pro | $50 | 700 |
| Studio | $120 | 1.800 |
Consulta la panoramica completa su prezzi.
Prova Seedance 2.0 Reference: generazione video multimodale
Abbina il tuo stile visivo con fino a 9 immagini di riferimento. Crediti gratuiti, nessuna carta richiesta.
Prova Seedance 2.0 Reference gratisDove la modalità reference si guadagna il suo posto
Video brand. Carica la tua fotografia di prodotto, il materiale creativo delle campagne esistenti, i colori del brand. L'output corrisponde alla tua identità visiva senza che tu debba descriverla.
Serie video con stile coerente. Stai girando una sequenza in 10 parti? Usa lo stesso bundle di riferimenti per ogni generazione e i pezzi sembreranno usciti da un unico set.
Lookbook e moda. La modalità reference è eccezionale nel riprodurre uno stile fotografico, illuminazione da studio, compressione dell'obiettivo, colori del guardaroba, su più modelle e pose.
Dallo storyboard al video. Fornisci al modello il tuo concept art e ottieni versioni animate nello stesso stile. Niente più compromessi "più o meno simili".
Pre-visualizzazione di video musicali. Riferimenti audio più riferimenti visivi più un prompt equivalgono a un rough cut che riflette davvero l'atmosfera del brano.
L'output: cosa ottieni
Ogni generazione con Seedance 2.0 Reference produce:
- Video 720p a 24 fps
- Da 4 a 15 secondi di durata (a tua scelta)
- Sincronizzazione audio nativa: audio ambientale generato per abbinarsi alla scena
- Tre aspect ratio: 16:9, 9:16, 1:1
- Consegna in 60-180 secondi a seconda della lunghezza
L'audio nativo merita di essere sottolineato. Anche senza riferimenti audio, ottieni un'ambienza in stile foley integrata. Con i riferimenti audio, ottieni un'ambienza che corrisponde al tuo indicatore di umore.
Prompt e riferimento: il workflow ibrido
L'errore più comune è appoggiarsi completamente ai riferimenti e scrivere un prompt pigro. I riferimenti gestiscono lo stile. Il prompt deve ancora fare il lavoro pesante su soggetto, azione e composizione.
Un buon prompt ibrido è così:
Una donna con un trench rosso che cammina in un vicolo di Tokyo sotto la pioggia
di notte, insegne al neon riflesse nelle pozzanghere, lento carrello in avanti, effetto
handheld, cinematografico
Con 6 immagini di riferimento cyberpunk allegate, il modello sa cosa significa "cinematografico" per questo set. Non deve indovinare.
Come Seedance 2.0 Reference si inserisce nella lineup ByteDance
Se hai seguito le uscite di video AI di ByteDance, sai che ora esiste un'intera famiglia: Seedance 1.0 Pro, Seedance 2.0, Seedream per le immagini fisse e la linea di avatar OmniHuman.
Seedance 2.0 Reference è il pezzo più recente e il più specializzato. Non è pensato per sostituire Seedance 2.0 standard: per clip singole da un prompt, quello standard è più veloce e meno costoso da iterare. La modalità reference è per quando hai bisogno che il tuo output corrisponda a qualcosa.
Per iniziare in meno di cinque minuti
- Vai su arteza.ai/create/seedance-2-reference
- Accedi (10 crediti gratuiti vengono applicati automaticamente)
- Carica 3-9 immagini di riferimento che rappresentano il tuo stile target
- Aggiungi facoltativamente 1-3 video di riferimento per il movimento e 1-3 clip audio per l'atmosfera
- Scrivi il tuo prompt descrivendo il soggetto e l'azione
- Scegli una durata (5 secondi è un buon primo test)
- Genera
La tua prima clip è pronta per il download in circa 90 secondi.
I limiti onesti
La modalità reference non è magia. Se le tue 9 immagini di riferimento si contraddicono tra loro, metà horror cupo e metà commedia luminosa, il modello le media e ottieni qualcosa di piatto. Seleziona con cura.
Inoltre non è in grado di generare dialoghi originali o musica. La sincronizzazione audio è ambientale e in stile foley. Per talking head con lip sync usa OmniHuman.
E sebbene il modello sia efficace nel trasferimento di stile, non è uno strumento di face-swap perfetto. Usare immagini di riferimento di una persona specifica catturerà il suo aspetto generale ma non la sua somiglianza esatta. È una caratteristica, non un difetto.
Prossimi passi
Se vuoi il tutorial pratico per la tua prima generazione, leggi il nostro guida ai video con stile coerente. Se stai scegliendo tra varianti, il confronto Reference vs Standard lo spiega nel dettaglio. E se arrivi da un'altra piattaforma, l'articolo Reference vs Runway copre il passaggio.
Seedance 2.0 Reference è il primo modello video AI che tratta il tuo stile visivo come input anziché come interpretazione. Provalo con i tuoi riferimenti e scopri cosa succede.
Il tuo moodboard, il tuo video
Carica fino a 9 immagini, 3 video e 3 clip audio. Ottieni un video AI corrispondente in meno di 3 minuti.
Inizia a creare gratisProva Seedance 2.0 - Ora stesso
5 generazioni gratuite · Nessuna carta di credito richiesta