Seedance 2.0 Reference: Multimodales KI-Video aus Bildern, Videos und Audio
Seedance 2.0 Reference ist die einzige Seedance-Variante, die bis zu 9 Bilder, 3 Videos und 3 Audioclips als Stilreferenzen akzeptiert. So verändert sie das Spiel für konsistentes KI-Video.

Neun Bilder. Drei Videos. Drei Audioclips. Eine KI-Videogenerierung. Das ist das einzigartige Konzept von Seedance 2.0 Reference, dem einzigen Modell in der Seedance-Reihe, das Stil als erstklassigen Input behandelt und nicht als nachträglichen Gedanken im Prompt.
Wer schon einmal versucht hat, einen einheitlichen Look über eine Reihe von KI-Videos hinweg zu erhalten, kennt den Schmerz. Standard-Text-zu-Video-Modelle interpretieren "cinematic", "moody" und "warm film grain" so, wie ein gelangweilter Praktikant ein Briefing interpretiert. Seedance 2.0 Reference überspringt die Interpretation und schaut direkt auf die Arbeit, die du emulieren möchtest.
Kurz zusammengefasst
- Akzeptiert bis zu 9 Referenzbilder, 3 Referenzvideos und 3 Audioclips pro Generierung
- Preis: 0,3024 Dollar pro Sekunde -> 19-154 Credits ($1,90-$15,40) pro Clip
- Ausgabe: 720p, 4-15 Sekunden Laufzeit, native Audiosynchronisierung inklusive
- Generierungszeit: 60-180 Sekunden je nach Cliplänge
- Die einzige Seedance-Variante, die für multimodalen Stiltransfer entwickelt wurde
- Jetzt kostenlos testen mit 10 Credits, keine Kreditkarte erforderlich auf arteza.ai
Was "multimodales Referencing" wirklich bedeutet
Die meisten KI-Videomodelle akzeptieren eines von zwei Dingen: einen Prompt oder einen Prompt plus ein einzelnes Startbild. Seedance 2.0 Reference akzeptiert ein ganzes Moodboard an Eingaben und behandelt sie als einheitliches Stil-Briefing.
Lade neun Standbilder aus einem Cyberpunk-Film hoch und das Modell passt die Farbgebung, das Linsengefühl und die Neon-auf-nassem-Asphalt-Beleuchtung an. Füge einen kurzen Clip hinzu, der genau die Kamerabewegung zeigt, die du möchtest. Leg einen Audioreferenz für die Stimmung des Soundtracks ein. Das Modell verbindet alles miteinander.
Das ist wichtig, weil Stil mehrdimensional ist. Ein "Retro-80er"-Look ist keine einzelne Sache, sondern ein Zusammenspiel aus Korn, Farbtemperatur, Linsenreflexen, Filmgate-Bewegung und spezifischen Kompositionen. Das in Worten zu beschreiben bedeutet Informationsverlust. Es mit 9 Bildern zu zeigen bedeutet fast keinen Verlust.

Bereit, deinen eigenen visuellen Stil zu übertragen? Seedance 2.0 Reference akzeptiert dein gesamtes Moodboard in einer einzigen Generierung. Kostenlos mit 10 Credits testen.
5 kostenlose Generierungen · Keine Kreditkarte erforderlich
Die Eingaben im Detail
Referenzbilder (bis zu 9). Das Herzstück des Modells. Damit legst du Farbpalette, Beleuchtungsstil, Erscheinungsbild der Motive, Kompositionsregeln und Texturen fest. Mehr Referenzen bedeuten in der Regel eine engere Stilübertragung. Neun ist das Maximum, weil die Fusion darüber hinaus beginnt, deine Absicht zu verwässern.
Referenzvideos (bis zu 3). Diese nutzt du für Bewegungshinweise: Kamerabewegungen, Tempo, Actionbeats. Das Modell entnimmt Bewegungsvektoren aus den Referenzen und integriert sie in die Ausgabe. Eine Handkamera-Referenz plus eine Dolly-Referenz ergibt etwas dazwischen.
Referenzaudio (bis zu 3). Es geht weniger um den Klang selbst als um die Stimmung, die er vermittelt. Atmosphärische Referenzen lenken die visuelle Stimmung: Ein stürmischer Audiotrack schiebt die Generierung in Richtung stürmischerer Bilder, auch wenn du kein Wetter angegeben hast.
Textprompt. Weiterhin erforderlich. Referenzen sagen dem Modell wie; der Prompt sagt ihm was.
Vergleich mit Standard Seedance 2.0
Standard Seedance 2.0 ist ein bewährtes Text-zu-Video- und Bild-zu-Video-Modell. Es akzeptiert einen Prompt und optional ein Bild. Das war es. Die Reference-Variante ist dasselbe zugrunde liegende Modell mit einer erheblich erweiterten Eingabeoberfläche.
| Funktion | Seedance 2.0 | Seedance 2.0 Reference |
|---|---|---|
| Textprompt | Ja | Ja |
| Bildeingabe | 1 Bild | Bis zu 9 Bilder |
| Videoreferenz | Nein | Bis zu 3 Videos |
| Audioreferenz | Nein | Bis zu 3 Audioclips |
| Kosten pro Sekunde | 0,3034 Dollar | 0,3024 Dollar |
| Ideal für | Schnelle Generierung aus einem Prompt | Stilkonsistente Serien, Markenvideos, Lookbooks |
Der Sekundenpreis ist nahezu identisch. Was sich ändert, ist, was du dem Modell füttern kannst, und was das ermöglicht.
Preise: Was du wirklich zahlst
Seedance 2.0 Reference wird mit etwa 2,9 Credits pro Sekunde Ausgabe abgerechnet. Das lässt sich klar aufschlüsseln:
| Laufzeit | Credits | USD |
|---|---|---|
| 4 Sekunden | 19 | $1.90 |
| 5 Sekunden | 23 | $2.30 |
| 8 Sekunden | 37 | $3.70 |
| 10 Sekunden | 46 | $4.60 |
| 15 Sekunden | 69 | $6.90 |
Die Referenzen selbst sind kostenlos. Du zahlst für die Ausgabedauer, nicht für die Anzahl der Eingaben. Neun Bilder kosten genauso viel wie eines.
Neue Konten erhalten 10 kostenlose Credits bei der Registrierung, keine Kreditkarte, kein Jahresvertrag. Das reicht für deinen ersten Test im Reference-Modus. Danach wählst du den monatlichen Plan, der zu dir passt:
| Plan | Preis | Monatliche Credits |
|---|---|---|
| Starter | $5 | 60 |
| Creator | $25 | 300 |
| Pro | $50 | 700 |
| Studio | $120 | 1.800 |
Die vollständige Übersicht findest du auf Preise.
Seedance 2.0 Reference testen - multimodale Videogenerierung
Passe deinen visuellen Stil mit bis zu 9 Bildreferenzen an. Kostenlose Credits, keine Kreditkarte erforderlich.
Seedance 2.0 Reference kostenlos testenWo der Reference-Modus seinen Wert beweist
Markenvideos. Lade deine Produktfotografie, dein bestehendes Werbematerial und deine Markenfarben hoch. Die Ausgabe entspricht deiner visuellen Identität, ohne dass du sie beschreiben musst.
Videoserien mit einheitlichem Stil. Du drehst eine 10-teilige Sequenz? Verwende dasselbe Referenzbündel bei jeder Generierung und die Einzelteile wirken wie aus einem einzigen Dreh.
Lookbooks und Mode. Der Reference-Modus eignet sich hervorragend, um einen Fotografiestil, Studio-Beleuchtung, Linsenkompression und Farbgebung der Kleidung, über mehrere Models und Posen hinweg beizubehalten.
Storyboard zu Video. Gib dem Modell dein Konzeptkunstwerk und erhalte animierte Versionen im selben Stil. Keine halben Kompromisse mehr.
Musikvideo-Vorabvisualisierung. Audioreferenzen plus visuelle Referenzen plus ein Prompt ergeben einen groben Schnitt, der tatsächlich die Stimmung des Songs widerspiegelt.
Die Ausgabe: Was du bekommst
Jede Seedance 2.0 Reference-Generierung liefert:
- 720p-Video mit 24 fps
- 4 bis 15 Sekunden Laufzeit (du wählst)
- Native Audiosynchronisierung: Umgebungssound, der zur Szene generiert wird
- Drei Seitenverhältnisse: 16:9, 9:16, 1:1
- Lieferung in 60 bis 180 Sekunden je nach Länge
Der native Audio-Aspekt verdient besondere Aufmerksamkeit. Auch ohne Audioreferenzen erhältst du Foley-artige Atmosphäre direkt eingebaut. Mit Audioreferenzen erhältst du eine Atmosphäre, die deinem Stimmungshinweis entspricht.
Prompt und Referenz: Der hybride Workflow
Der häufigste Fehler ist, sich vollständig auf Referenzen zu verlassen und einen laschen Prompt zu schreiben. Referenzen steuern den Stil. Der Prompt muss die Hauptarbeit bei Motiv, Aktion und Komposition leisten.
Ein guter hybrider Prompt sieht so aus:
Eine Frau in einem roten Trenchcoat, die durch eine regenassen Tokioter Gasse
läuft, nachts, Neonlichter spiegeln sich in Pfützen, langsamer Dolly vorwärts,
Handkamera-Gefühl, cinematisch
Mit 6 angehängten Cyberpunk-Referenzbildern weiß das Modell, was "cinematisch" für diesen Dreh bedeutet. Es muss nicht raten.
Wie Seedance 2.0 Reference in die ByteDance-Produktreihe passt
Wer die KI-Video-Veröffentlichungen von ByteDance verfolgt hat, weiß, dass es inzwischen eine ganze Familie gibt: Seedance 1.0 Pro, Seedance 2.0, Seedream für Standbilder und die OmniHuman-Avatar-Reihe.
Seedance 2.0 Reference ist das neueste und speziellste Modell dieser Familie. Es soll Standard Seedance 2.0 nicht ersetzen: Für einzelne Clips aus einem Prompt ist die Standardversion schneller und günstiger in der Iteration. Der Reference-Modus ist dafür gedacht, wenn deine Ausgabe zu etwas passen muss.
In unter fünf Minuten loslegen
- Gehe zu arteza.ai/create/seedance-2-reference
- Melde dich an (10 kostenlose Credits werden automatisch gutgeschrieben)
- Lade 3-9 Referenzbilder hoch, die deinen Zielstil repräsentieren
- Füge optional 1-3 Referenzvideos für Bewegung und 1-3 Audioclips für Stimmung hinzu
- Schreibe deinen Prompt, der Motiv und Aktion beschreibt
- Wähle eine Laufzeit (5 Sekunden sind ein guter erster Test)
- Generieren
Dein erster Clip ist in etwa 90 Sekunden zum Download bereit.
Die ehrlichen Einschränkungen
Der Reference-Modus ist keine Magie. Wenn sich deine 9 Referenzen widersprechen, zur Hälfte düsterer Horror und zur Hälfte helle Komödie, wird das Modell sie mitteln und du erhältst etwas Blasses. Kuratiere sorgfältig.
Er kann auch keine originalen Dialoge oder Musik generieren. Die Audiosynchronisierung ist Atmosphäre und Foley. Für lippensynchronisierte Sprechköpfe empfiehlt sich stattdessen OmniHuman.
Und obwohl das Modell stark im Stiltransfer ist, ist es kein perfektes Face-Swap-Tool. Das Verwenden von Referenzbildern einer bestimmten Person erfasst deren allgemeines Erscheinungsbild, aber nicht die exakte Ähnlichkeit. Das ist ein Feature, kein Bug.
Nächste Schritte
Wenn du das praktische Tutorial für deine erste Generierung möchtest, lies unseren Leitfaden für stilkonsistente Videos. Wenn du dich zwischen verschiedenen Varianten entscheidest, schlüsselt der Reference vs. Standard-Vergleich alles auf. Und wenn du von einer anderen Plattform wechselst, behandelt der Reference vs. Runway-Artikel den Umstieg.
Seedance 2.0 Reference ist das erste KI-Videomodell, das deinen visuellen Stil als Input statt als Interpretation behandelt. Teste es mit deinen eigenen Referenzen und schau, was passiert.
Dein Moodboard, dein Video
Lade bis zu 9 Bilder, 3 Videos und 3 Audioclips hoch. Erhalte ein passendes KI-Video in unter 3 Minuten.
Kostenlos loslegenSeedance 2.0 ausprobieren - Jetzt!
5 kostenlose Generierungen · Keine Kreditkarte erforderlich