Seedance 2.0 Reference: Multi-Modal AI-Video aus Bildern, Videos und Audio
Seedance 2.0 Reference ist die einzige Seedance-Variante, die bis zu 9 Bilder, 3 Videos und 3 Audioclips als Stil-Referenzen akzeptiert. Hier erfährst du, wie es das Spiel für konsistente KI-Videos verändert.

Neun Bilder. Drei Videos. Drei Audioclips. Ein KI-Videogenerator. Das ist das einzigartige Angebot von Seedance 2.0 Reference, und es ist das einzige Modell in der Seedance-Reihe, das Style wie einen First-Class-Input behandelt und nicht als Nachgedanken einer Eingabeaufforderung.
Wenn Sie jemals versucht haben, einen konsistenten Look über einen Stapel von KI-Videos hinweg beizubehalten, kennen Sie den Schmerz. Standard-Text-zu-Video-Modelle interpretieren "kinematisch", "düster" und "warmes Filmkorn" so, wie ein gelangweilter Praktikant ein Briefing interpretiert. Seedance 2.0 Reference überspringt die Interpretation und schaut direkt auf die Arbeit, die Sie emulieren möchten.
TL;DR
- Akzeptiert bis zu 9 Referenzbilder, 3 Referenzvideos und 3 Audioclips pro Generierung
- Preisgestaltung: 0,3024 Dollar pro Sekunde → ungefähr 243 bis 907 Credits (2,42 bis 9,07 Dollar) pro Clip
- Ausgabe: 720p, 4-15 Sekunden Dauer, natives Audio-Sync integriert
- Generierungszeit: 60-180 Sekunden je nach Clip-Länge
- Die einzige Seedance-Variante für Multi-Modal-Style-Transfer
- Kostenlos mit 50 Credits testen, keine Karte erforderlich unter arteza.ai
Was "Multi-Modal Reference" wirklich bedeutet
Die meisten KI-Videomodelle akzeptieren eines von zwei Dingen: eine Eingabeaufforderung oder eine Eingabeaufforderung plus ein einzelnes Startbild. Seedance 2.0 Reference akzeptiert eine ganze Moodboard voller Eingaben und behandelt sie als eine einheitliche Style-Anweisung.
Laden Sie neun Stills aus einem Cyberpunk-Film hoch und es passt den Farbverlauf, das Objektiv-Feeling und die Neon-auf-nassem-Asphalt-Beleuchtung an. Fügen Sie einen kurzen Clip hinzu, der genau die Kamerabewegung hat, die Sie möchten. Fügen Sie eine Audio-Referenz für die Stimmung des Soundtracks hinzu. Das Modell verschmilzt alles.
Das ist wichtig, weil Style mehrdimensional ist. Ein "Retro-80er"-Look ist nicht eine Sache - es ist Körnung, Farbtemperatur, Lens Flares, Filmtor-Weave und spezifische Kompositionen. Das in Worten zu beschreiben, verliert Information. Es mit 9 Bildern zu zeigen, verliert fast nichts.

Bereit, Ihren eigenen visuellen Style anzupassen? Seedance 2.0 Reference akzeptiert Ihr gesamtes Moodboard in einer einzigen Generierung. Kostenlos mit 50 Credits ausprobieren.
5 kostenlose Generierungen · Keine Kreditkarte erforderlich
Die Eingaben erklärt
Referenzbilder (bis zu 9). Das Herzstück des Modells. Verwenden Sie diese, um Farbpalette, Beleuchtungsstil, Subjekterscheinung, Kompositionsregeln und Textur zu sperren. Mehr Referenzen führen im Allgemeinen zu strafferer Style-Einhaltung. Neun ist die Obergrenze, da darüber hinaus die Fusion beginnt, Ihre Absicht zu mitteln.
Referenzvideos (bis zu 3). Verwenden Sie diese für Bewegungshinweise - Kamerabewegungen, Geschwindigkeit, Action-Beats. Das Modell sampelt Bewegungsvektoren aus den Referenzen und mischt sie in die Ausgabe. Eine Handheld-Referenz plus eine Dolly-Referenz geben Ihnen etwas dazwischen.
Referenzaudio (bis zu 3). Weniger über den Sound selbst und mehr über die Stimmung, die er impliziert. Ambient-Referenzen leiten die visuelle Atmosphäre - ein stürmischer Audio-Track wird die Generierung in Richtung stürmischer Visuals drängen, auch wenn Sie das Wetter nicht angegeben haben.
Textliche Eingabeaufforderung. Immer noch erforderlich. Referenzen sagen dem Modell wie; die Eingabeaufforderung sagt ihm was.
Wie es sich mit Standard-Seedance 2.0 vergleicht
Standard Seedance 2.0 ist ein Text-zu-Video- und Bild-zu-Video-Workhorse. Es akzeptiert eine Eingabeaufforderung und optional ein Bild. Das ist alles. Die Reference-Variante ist dasselbe zugrundeliegende Modell mit einer drastisch erweiterten Eingabefläche.
| Funktion | Seedance 2.0 | Seedance 2.0 Reference |
|---|---|---|
| Textliche Eingabeaufforderung | Ja | Ja |
| Bildeingabe | 1 Bild | Bis zu 9 Bilder |
| Videoreferenz | Nein | Bis zu 3 Videos |
| Audioreferenz | Nein | Bis zu 3 Audioclips |
| Kosten pro Sekunde | 0,3034 Dollar | 0,3024 Dollar |
| Best for | Schnelle Generierung aus einer Eingabeaufforderung | Style-konsistente Serie, Brand-Videos, Lookbooks |
Die Preisgestaltung pro Sekunde ist nahezu identisch. Was sich ändert, ist das, was Sie in das Modell einspeisen können - und was das freischaltet.
Preisgestaltung: Was Sie wirklich zahlen
Seedance 2.0 Reference berechnet 0,3024 Dollar pro Sekunde Ausgabe. Das wird sauber aufgeteilt:
| Dauer | Credits | USD |
|---|---|---|
| 4 Sekunden | 243 | 2,42 Dollar |
| 5 Sekunden | 303 | 3,02 Dollar |
| 8 Sekunden | 484 | 4,84 Dollar |
| 10 Sekunden | 605 | 6,05 Dollar |
| 15 Sekunden | 907 | 9,07 Dollar |
Die Referenzen selbst sind kostenlos. Sie zahlen für die Ausgabedauer, nicht für die Eingabeanzahl. Neun Bilder kosten genauso viel wie eins.
Neue Konten erhalten 50 kostenlose Credits bei der Anmeldung, erschwingliche Abonnementpläne, keine Karte erforderlich. Das reicht aus, um Ihren ersten Reference-Modus-Test durchzuführen. Von dort aus können Sie je nach Ihrem Tarif aufladen:
| Credit-Paket | Preis | Credits |
|---|---|---|
| Starter | 10 Dollar | 1.050 |
| Popular | 25 Dollar | 2.750 |
| Pro | 50 Dollar | 5.750 |
| Max | 100 Dollar | 12.000 |
Sehen Sie die vollständige Aufschlüsselung unter Preisgestaltung.
Seedance 2.0 Reference ausprobieren - Multi-Modal-Videogenerierung
Passen Sie Ihren visuellen Style mit bis zu 9 Bildreferenzen an. 50 kostenlose Credits, keine Karte erforderlich.
Seedance 2.0 Reference kostenlos ausprobierenWo Reference Mode sich bewährt
Brand-Videos. Laden Sie Ihre Produktfotografie, Ihre vorhandene Anzeigenkreativität, Ihre Brand-Farben hoch. Die Ausgabe passt Ihre visuelle Identität an, ohne dass Sie sie beschreiben müssen.
Videoserie mit konsistentem Style. Drehen Sie eine 10-teilige Sequenz? Verwenden Sie das gleiche Reference-Bundle für jede Generierung und die Teile werden sich anfühlen, als kämen sie aus einem Shooting.
Lookbooks und Mode. Reference Mode ist außergewöhnlich gut darin, einen Fotografie-Style - Studio-Beleuchtung, Linsenkompressions-Gefühl, Garderobe-Farben - über mehrere Modelle und Posen hinweg anzupassen.
Storyboard-zu-Video. Füttern Sie das Modell mit Ihrem Concept Art und erhalten Sie bewegte Versionen im gleichen Style. Keine "nahezu genug" Kompromisse mehr.
Musikvideo-Vorabvisit. Audio-Referenzen plus visuelle Referenzen plus eine Eingabeaufforderung entsprechen einem rohen Schnitt, der tatsächlich die Stimmung des Songs widerspiegelt.
Die Ausgabe: Was Sie erhalten
Jede Seedance 2.0 Reference Generierung erzeugt:
- 720p Video bei 24 fps
- 4 bis 15 Sekunden Dauer (Sie wählen)
- Natives Audio-Sync - Ambient-Audio, das der Szene entspricht, generiert
- Drei Seitenverhältnisse: 16:9, 9:16, 1:1
- Lieferung in 60 bis 180 Sekunden je nach Länge
Das native Audio ist erwähnenswert. Auch ohne Audio-Referenzen erhalten Sie Foley-ähnliche Umgebung integriert. Mit Audio-Referenzen erhalten Sie Umgebung, die Ihrem Stimmungshinweis entspricht.
Eingabeaufforderung + Referenz: Der Hybrid-Workflow
Der Fehler, den Menschen machen, ist, sich vollständig auf Referenzen zu verlassen und eine faule Eingabeaufforderung zu schreiben. Referenzen handhaben Style. Die Eingabeaufforderung muss immer noch die schwere Arbeit bei Subjekt, Aktion und Komposition leisten.
Eine gute Hybrid-Eingabeaufforderung sieht so aus:
Eine Frau in einem roten Trenchcoat, die nachts durch eine regennasse
Tokio-Gasse geht, Neonlichter, die sich in Pfützen spiegeln, langsame
Dolly-Bewegung nach vorne, Handheld-Feeling, kinematisch
Mit 6 Cyberpunk-Referenzbildern angehängt, weiß das Modell, was "kinematisch" für diesen Dreh bedeutet. Es muss nicht raten.
Wie Seedance 2.0 Reference in die ByteDance-Reihe passt
Wenn Sie ByteDance's KI-Videoveröffentlichungen verfolgt haben, wissen Sie, dass es jetzt eine ganze Familie gibt: Seedance 1.0 Pro, Seedance 2.0, Seedream für Stills und die OmniHuman Avatar-Reihe.
Seedance 2.0 Reference ist das neueste Stück und das speziellste. Es soll Standard-Seedance 2.0 nicht ersetzen - für einmalige Clips aus einer Eingabeaufforderung ist Standard schneller und billiger zum Iterieren. Reference Mode ist für diejenigen, denen Ihre Ausgabe etwas entsprechen muss.
In unter fünf Minuten loslegen
- Gehen Sie zu arteza.ai/create/seedance-2-reference
- Melden Sie sich an (50 kostenlose Credits werden automatisch angewendet)
- Laden Sie 3-9 Referenzbilder hoch, die Ihren Zielstyle darstellen
- Fügen Sie optional 1-3 Referenzvideos für Bewegung und 1-3 Audioclips für Stimmung hinzu
- Schreiben Sie Ihre Eingabeaufforderung, die das Subjekt und die Aktion beschreibt
- Wählen Sie eine Dauer (5 Sekunden ist ein guter erster Test)
- Generieren
Ihr erster Clip wird in etwa 90 Sekunden heruntergeladen.
Die ehrlichen Einschränkungen
Reference Mode ist keine Magie. Wenn Ihre 9 Referenzen sich widersprechen - halb düsterer Horror, halb helle Komödie - wird das Modell sie mitteln und Sie bekommen etwas Langweiliges. Kuratieren Sie eng.
Es kann auch keinen ursprünglichen Dialog oder Musik generieren. Das Audio-Sync ist Ambient- und Foley-Sound. Für Lip-Sync-Talking-Heads möchten Sie stattdessen OmniHuman.
Und während das Modell bei der Style-Übertragung stark ist, ist es kein perfektes Face-Swap-Tool. Die Verwendung von Referenzbildern einer bestimmten Person erfasst ihren allgemeinen Look, aber nicht ihre exakte Ähnlichkeit. Das ist ein Feature, kein Bug.
Nächste Schritte
Wenn Sie das praktische Tutorial für Ihre erste Generierung möchten, lesen Sie unseren Leitfaden für stilkonsistente Videos. Wenn Sie zwischen Varianten entscheiden, breitet der Reference vs Standard Vergleich es auf. Und wenn Sie von einer anderen Plattform kommen, deckt das Reference vs Runway Stück den Wechsel ab.
Seedance 2.0 Reference ist das erste KI-Videomodell, das Ihren visuellen Style als Input statt als Interpretation behandelt. Probieren Sie es mit Ihren eigenen Referenzen aus und sehen Sie, was passiert.
Ihr Moodboard, Ihr Video
Laden Sie bis zu 9 Bilder, 3 Videos und 3 Audioclips hoch. Bekommen Sie ein entsprechendes KI-Video in unter 3 Minuten.
Kostenlos kreativ werdenTry Seedance 2.0 - Right Now
5 free generations · No credit card needed