Luotu tällä sovelluksella
Gemini Omni Flash 1.1 on Googlen multimodaalinen videomallia, joka on saatavilla tässä sovelluksessa lyhytmuotoisen videon luomiseen ja muokkaamiseen. Se hyväksyy tekstikehotteet, pysäytyskuvia, valinnaisen lopetuskehyksen, jopa kymmenen referenssikuvaa tai kolme referenssivideota, ja se voi muokata olemassa olevaa videota tavallisen kielen ohjeella. Tuotanto kestää 360p:stä 4K:een kolmesta kymmeneen sekuntiin, ja siihen sisältyy natiivisti synkronoitu ääni. Se sopii luojille, markkinoijille ja kehittäjille, jotka tarvitsevat tarkkaa visuaalista jatkuvuutta, luettavaa tekstiä näytöllä ja kiilloitettua ääntä ilman erillistä äänimuokkausta.
Kuinka käyttää tätä sovellusta
- 1
Kuvaile mitä haluat luoda tai lataa lähdetiedostosi.
- 2
Valitse vaihtoehdot ja paina Luo.
- 3
Katso tuloksesi ilmestyvän galleriaan hetken kuluttua.
- 4
Lataa, jaa tai luo uudella idealla.
Mitä voit luoda
Tuotteen lähikuva äänellä
Kuvaile tuotetta, toimita pysäytyskuva aloituskehykseksi ja anna mallin animoida se 4K:lla synkronoidulla ympäristö- tai puheääniäänellä. Mallin maailmantietämys pitää etikettejä ja tekstiä pakkauksissa luettavina jokaisessa kehyksessä, mikä poistaa yleisen ongelman tekoälytuotevideossa.
Referenssiin perustuva hahmon johdonmukaisuus
Lataa jopa kymmenen referenssikuvaa hahmosta tai paikasta ohjataksesi luontia. Gemini Omni Flash 1.1 säilyttää visuaalisen identiteetin johdonmukaisena leikkausten yli, mikä tekee siitä käytännöllisen storyboard-tyylisille sarjoille, brändättyille maskoteille tai toistuvaille kohtauksille, joiden on näytettävä samalta kuva kuvalta.
Olemassa olevan videoleikkeen muokkaaminen ohjeella
Pudota lähdevideo ja kirjoita tavallisen kielen muokkausohje, kuten 'tee taivas pilvinen' tai 'poista taustan sotkut'. Malli soveltaa muutoksen ilman erillistä komposointivaiheetta, mikä on hyödyllistä nopeille muutoskierroksille videolla, joka on muuten valmis.
Tekstin päällekkäisyyden liikegraafiikka
Koska malli perustuu Geminin maailmantietämykseen, näytöllä oleva teksti renderöityy oikein ja pysyy terävänä liikkeen läpi. Käytä tätä kineettisille otsikoille, alariveille tai tietojen korostuksille, joissa muut generatiiviset mallit tuottavat tyypillisesti sekavaa tai ajautuvaa tekstiä.
Kuvan videoksi tarinan osiksi
Toimita aloituskuva ja valinnainen lopetuskehys määrittääksesi kohtauksen ensimmäisen ja viimeisen hetken, sitten anna mallin interpoloida toiminta niiden välillä. Tämä toimii hyvin käsiteesittelyille, animatiikalle ja pitch-esittelyille, joissa tarvitset hallittua liikettä staattisesta kuvituksesta.
Kokeiltavia prompt-ideoita
Miksi luojat käyttävät tätä sovellusta
- Natiivi synkronoitu ääni
- 360p - 4K Ulostulo
- 3-10s Kesto
- Teksti, kuva ja referenssi sisäänmeno
- Referenssi videon ohjaus
- Muokkaa videota ohjeella
Vinkkejä parempiin tuloksiin
Ankkuroi teksti kehottella
Kun videosi tarvitsee luettavaa tekstiä, kirjoita sanat tarkasti kehottimeen. Gemini Omni Flash 1.1 perustuu maailmantietämykseen, mikä antaa sille etua kirjainmuodon tarkkuudessa, mutta eksplisiittinen kehotus silti vähentää ajautumista ja varmistaa, että malli priorisoi tämän elementin.
Käytä lopetuskehystä hallintaan
Sekä aloituskuvan että lopetuskehyksen toimittaminen antaa mallille kaksi ankkuria interpoloida niiden välillä. Tämä on luotettavin tapa hallita kaaria ja koostumusta, kun tarvitset tietyn visuaalisen palkinnon leikkeen lopussa avoimien liikkeiden sijaan.
Kerro referenssisyötteet strategisesti
Malli hyväksyy jopa kymmenen referenssikuvaa ja kolme referenssivideota samanaikaisesti. Käytä kuvapaikkoja hahmon tai objektin johdonmukaisuuteen ja videoleikkeiden paikkoja liikkeen tyylin tai kameran käyttäytymisen määrittämiseen. Molempien syötetyyppien sekoittaminen yhdessä luonnissa antaa sinulle hienomman ohjauksen kuin kumpikaan yksin.
Kirjoita muokkausohjeet tarkasti
Kun käytät videomuokkausmuotoa, kuvaile mitä muuttaa ja mitä säilyttää samassa ohjeessa. Lause kuten 'muuta seinän väri syvän sinivihreäksi, pidä huonekalut ja valaistus identtisinä' on paljon tehokkaampi kuin epämääräinen direktiivi, koska se asettaa eksplisiittiset rajoitukset sekä muokkaukselle että muuttumattomille elementeille.
Milloin valita tämä sovellus
Valitse tämä sovellus, kun prioriteettisi on 4K resoluutio natiivisti synkronoidulla äänellä yhdestä luontikierroksesta, referenssiin ohjattu visuaalinen jatkuvuus useiden omaisuuksien yli, luettava näytöllä oleva teksti tai kyky muokata olemassa olevaa leikettä kirjoitetulla ohjeella. Seedance 2.5 kattaa pidemmät ajot jopa 30 sekuntiin ja hyväksyy paljon enemmän referenssimateriaalia, mikä on parempi valinta, kun kesto tai referenssin syvyys on tärkeämpää kuin resoluutiotaso. Wan 3.0 tarjoaa 30 sekunnin yksittäisen luontikierroksen videon omni-referenssillä, mikä tekee siitä vahvemman valinnan laajennetuille kohtauksille. Gemini Omni Flash 1.1 on oikea valinta, kun tarvitset kolmen korkeimman tuotannon resoluution tai haluat muokata olemassa olevaa leikettä kirjoittamalla ohjeen sen sijaan, että regeneroisit sen.
Usein kysytyt kysymykset
Voinko luoda videon ilman kuvaa?
Kyllä. Sovellus hyväksyy pelkän tekstikehottimen. Kuvat, lopetuskehykset, referenssikuvat ja referenssivideot ovat kaikki valinnaisia syötteitä. Sinun tarvitsee toimittaa ne vain, kun haluat ohjata visuaalista jatkuvuutta, määrittää liikkeen päätepisteitä tai sovittaa tietty hahmo tai paikka lähdeaineistoosi.
Kuinka natiivisti synkronoitu ääni toimii tuotoksessa?
Gemini Omni Flash 1.1 tuottaa äänen osana samaa mallin kulkua, joka tuottaa videon, joten ääni on ajoitettu visuaaleihin sen sijaan, että se lisätään geneeriseksi raidaksi jälkikäteen. Tuloksena oleva MP4 sisältää äänikaistan jo upotettuna, valmiina käyttöön ilman erillistä miksausvaihetta.
Mikä on enimmäismäärä referenssisyötteitä, joita voin toimittaa?
Voit toimittaa jopa kymmenen referenssikuvaa ja jopa kolme referenssivideota yhdessä luonnissa. Nämä syötteet ohjaavat mallia kohti johdonmukaista visuaalista identiteettiä hahmoille, objekteille, paikoille tai kameran liikkeen tyylille riippuen siitä, mitä referenssit kuvaavat.
Toimiiko videomuokkausmuoto millä tahansa ladatulla leikkeellä?
Muokkausmuoto ottaa olemassa olevan videon lähteeksi ja soveltaa tavallisen kielen ohjeita sen muokkaamiseen. Malli tulkitsee luonnollisen kielen, joten sinun ei tarvitse määrittää teknisiä parametreja. Tulokset ovat johdonmukaisimpia, kun ohje selkeästi ilmoittaa sekä mitä muuttaa että mitä säilyttää.
Mitä resoluutiota valita sosiaaliseen tai verkkoon toimittamiseen?
Useimmille sosiaalisen median alustoille 1080p on käytännöllinen oletusarvo, koska se tasapainottaa visuaalisen laadun tiedoston koon ja latausvaatimusten kanssa. Käytä 4K:a, kun kohde tukee sitä, kuten korkearesoluutioisen näytön esittely tai alusta, joka pienentää suuremmasta lähteestä. 720p sopii esikatseluihin tai luonnoksiin. 360p on hyödyllinen nopealle iteraatiolle ennen kuin sitoudut lopulliseen resoluutioon.
Kuinka pidän hahmon johdonmukaisena useiden erillisten luontikierrosten yli?
Tallenna referenssikuvasi yhdestä luonnista ja toimita ne referenssisyötteinä seuraavassa. Malli hyväksyy jopa kymmenen referenssikuvaa per ajon, joten voit sisällyttää saman hahmon useita kulmia tai ilmeitä johdonmukaisuuden vahvistamiseksi. Kuvareferenssien yhdistäminen kuvaavaan kehottimeen, joka nimeää hahmon erottavat piirteet, parantaa koherenssia entisestään.
Mikä tekoäly-malli toimii tämän sovelluksen takana?
Tämä sovellus toimii mallilla Gemini Omni Flash 1.1, saatavilla Artezasta ilman erillistä tiliä tai asetuksia.
Voinko käyttää tuloksia kaupallisesti?
Kyllä. Luomasi sisältö on sinun omaksesi käyttää, tarvikkeistomme lisenssien mukaan.
Kuinka kauan sukupolvi kestää?
Suurin osa sukupolvi valmistuu alle minuutissa, ja voit seurata edistymistä live-galleriassa.