Accès illimité 3 jours à Seedance 2.5 + plusjusqu'à 25% de réduction

Réduction expire dans --

Créé avec cette application

Gemini Omni Flash 1.1 est le modèle vidéo multimodal de Google, disponible ici sous la forme d'une application spécialisée pour générer et éditer des vidéos courtes. Il accepte une invite textuelle, une image fixe, une image de fin optionnelle, jusqu'à dix images de référence ou trois clips de référence, et peut éditer une vidéo existante à partir d'une instruction en langage naturel. Les sorties s'étendent de 360p à 4K entre trois et dix secondes, avec audio synchronisé natif intégré. Elle convient aux créateurs, aux spécialistes du marketing et aux développeurs qui ont besoin d'une continuité visuelle précise, d'un texte lisible à l'écran et d'un audio soigné sans étape sonore supplémentaire.

Comment utiliser cette application

  1. 1

    Décrivez ce que vous voulez créer ou téléchargez votre fichier source.

  2. 2

    Choisissez vos options, puis appuyez sur Générer.

  3. 3

    Regardez votre résultat apparaître dans la galerie en quelques instants.

  4. 4

    Téléchargez, partagez ou générez à nouveau avec une nouvelle idée.

Ce que vous pouvez créer

Gros plan produit avec audio

Décrivez un produit, fournissez une photo fixe comme image de départ, et laissez le modèle l'animer à 4K avec un audio ambiant synchronisé ou de style voix hors champ. La connaissance du monde du modèle maintient les étiquettes et le texte sur l'emballage lisibles dans chaque image, éliminant un problème courant dans la vidéo produit générée par l'IA.

Continuité des personnages guidée par la référence

Téléchargez jusqu'à dix images de référence d'un personnage ou d'un lieu pour orienter la génération. Gemini Omni Flash 1.1 maintient l'identité visuelle cohérente d'un plan à l'autre, ce qui le rend pratique pour les séquences de style scénarimage, les mascottes de marque ou les décors récurrents qui doivent avoir le même aspect d'un plan à l'autre.

Édition d'un clip existant par instruction

Insérez une vidéo source et tapez une instruction d'édition en langage naturel comme « rendre le ciel couvert » ou « supprimer le désordre de l'arrière-plan ». Le modèle applique la modification sans étape de composition supplémentaire, utile pour les cycles de révision rapides sur des images qui sont autrement terminées.

Graphiques en mouvement avec superposition de texte

Parce que le modèle s'appuie sur la connaissance du monde de Gemini, le texte à l'écran s'affiche correctement et reste net en mouvement. Utilisez ceci pour les titres cinétiques, les tiers inférieurs ou les appels de données où d'autres modèles génératifs produisent généralement des caractères brouillés ou qui dérivent.

Séquences narratives image vers vidéo

Fournissez une image de départ et une image de fin optionnelle pour définir les premiers et derniers moments d'une scène, puis laissez le modèle interpoler l'action entre les deux. Cela fonctionne bien pour les présentations de concepts, les animatiques et les présentations de pitch où vous avez besoin d'un mouvement contrôlé à partir d'illustrations statiques.

Idées de prompts à essayer

Pourquoi les créateurs utilisent cette application

  • Audio synchronisé natif
  • Sortie de 360p à 4K
  • Durée : 3-10s
  • Entrée Texte, Image et Référence
  • Pilotage vidéo de référence
  • Modifier une vidéo par instruction

Conseils pour de meilleurs résultats

Ancrer le texte avec une invite

Quand votre vidéo a besoin de mots lisibles, épellez-les exactement dans l'invite. Gemini Omni Flash 1.1 s'appuie sur la connaissance du monde, ce qui lui donne un avantage en termes de précision des caractères, mais une invite explicite réduit quand même la dérive et garantit que le modèle priorise cet élément.

Utiliser l'image de fin pour le contrôle

Fournir à la fois une image de départ et une image de fin donne au modèle deux points d'ancrage pour interpoler entre eux. C'est le moyen le plus fiable de contrôler l'arc et la composition quand vous avez besoin d'un résultat visuel spécifique à la conclusion du clip plutôt qu'un mouvement ouvert.

Superposer les entrées de référence stratégiquement

Le modèle accepte jusqu'à dix images de référence et trois clips de référence simultanément. Utilisez les emplacements d'image pour la cohérence des personnages ou des objets et les emplacements de clip pour définir le style de mouvement ou le comportement de la caméra. Mélanger les deux types d'entrée dans une génération vous donne un contrôle plus fin que l'un ou l'autre seul.

Rédiger les instructions d'édition avec précision

Lors de l'utilisation du mode édition vidéo, décrivez ce qui doit changer et ce qui doit être préservé dans la même instruction. Une phrase comme « changer la couleur du mur en bleu canard profond, garder les meubles et l'éclairage identiques » est beaucoup plus efficace qu'une directive vague, car elle définit des contraintes explicites sur l'édition et les éléments inchangés.

Quand choisir cette application

Choisissez cette application quand votre priorité est la résolution 4K avec audio synchronisé natif d'une seule passe de génération, la continuité visuelle contrôlée par référence sur plusieurs ressources, le texte lisible à l'écran ou la capacité à éditer un clip existant par une instruction tapée. Seedance 2.5 couvre les exécutions plus longues jusqu'à 30 secondes et accepte beaucoup plus de matériel de référence, ce qui est un meilleur choix quand la durée ou la profondeur de référence importe plus que le niveau de résolution. Wan 3.0 offre une vidéo de 30 secondes en une seule passe avec référence omni, ce qui en fait le choix plus fort pour les scènes étendues. Gemini Omni Flash 1.1 est le bon choix quand vous avez besoin de la résolution de sortie la plus élevée des trois, ou quand vous voulez réviser un clip existant en tapant une instruction plutôt que de le régénérer.

Questions fréquemment posées

Puis-je générer une vidéo sans fournir d'image du tout ?

Oui. L'application accepte une invite textuelle seule. Les images, les images de fin, les images de référence et les clips de référence sont tous des entrées optionnelles. Vous n'avez besoin de les fournir que si vous voulez orienter la continuité visuelle, définir les points finaux du mouvement ou faire correspondre un personnage ou un lieu spécifique à votre matériel source.

Comment fonctionne l'audio synchronisé natif dans la sortie ?

Gemini Omni Flash 1.1 génère l'audio dans le cadre de la même passe de modèle qui produit la vidéo, de sorte que le son est synchronisé avec les visuels plutôt que d'être ajouté comme une piste générique après coup. Le fichier MP4 résultant inclut le canal audio déjà intégré, prêt à être utilisé sans étape de mixage supplémentaire.

Quel est le nombre maximum d'entrées de référence que je peux fournir ?

Vous pouvez fournir jusqu'à dix images de référence et jusqu'à trois clips vidéo de référence dans une seule génération. Ces entrées orientent le modèle vers une identité visuelle cohérente pour les personnages, les objets, les lieux ou le style de mouvement de la caméra, selon ce que les références dépeignent.

Le mode édition vidéo fonctionne-t-il sur n'importe quel clip téléchargé ?

Le mode édition prend une vidéo existante comme source et applique une instruction en langage naturel pour la modifier. Le modèle interprète le langage naturel, vous n'avez donc pas besoin de spécifier des paramètres techniques. Les résultats sont les plus cohérents quand l'instruction indique clairement à la fois ce qui doit changer et ce qui doit rester identique.

Quelle résolution dois-je choisir pour la diffusion sur les réseaux sociaux ou le web ?

Pour la plupart des plateformes de réseaux sociaux, 1080p est un choix pratique par défaut car il équilibre la qualité visuelle avec la taille du fichier et les exigences de téléchargement. Utilisez 4K quand la destination le supporte, comme une démo d'affichage haute résolution ou une plateforme qui réduit gracieusement à partir d'une source plus élevée. 720p convient aux aperçus ou aux brouillons. 360p est utile pour l'itération rapide avant de s'engager dans une résolution finale.

Comment garder un personnage cohérent sur plusieurs générations séparées ?

Enregistrez vos images de référence d'une génération et fournissez-les comme entrées de référence dans la suivante. Le modèle accepte jusqu'à dix images de référence par exécution, vous pouvez donc inclure plusieurs angles ou expressions du même personnage pour renforcer la cohérence. Combiner les références d'image avec une invite descriptive qui nomme les caractéristiques distinctives du personnage améliore encore la cohérence.

Quel modèle IA alimente cette application ?

Cette application fonctionne sur Gemini Omni Flash 1.1, disponible via Arteza sans compte ou configuration séparé.

Puis-je utiliser les résultats commercialement ?

Oui. Le contenu que vous générez vous appartient et peut être utilisé, conformément à nos licences de contenu.

Combien de temps prend une génération ?

La plupart des générations se terminent en moins d'une minute, et vous pouvez suivre la progression en direct dans la galerie.

Découvrir plus d'applications