Creado con esta app
Gemini Omni Flash 1.1 es el modelo de vídeo multimodal de Google, disponible aquí como una aplicación especializada para generar y editar vídeos de corta duración. Acepta un aviso de texto, una imagen fija, un fotograma final opcional, hasta diez imágenes de referencia o tres clips de referencia, y puede editar un vídeo existente a partir de una instrucción en lenguaje natural. La salida se ejecuta desde 360p hasta 4K con una duración de tres a diez segundos, con audio sincronizado nativo integrado. Es adecuado para creadores, especialistas en marketing y desarrolladores que necesitan continuidad visual precisa, texto legible en pantalla y audio pulido sin una pista de sonido separada.
Cómo usar esta app
- 1
Describe lo que quieres crear o sube tu archivo fuente.
- 2
Elige tus opciones y presiona Generar.
- 3
Observa tu resultado aparecer en la galería en momentos.
- 4
Descarga, comparte o genera de nuevo con una idea nueva.
Qué puedes crear
Primer plano de producto con audio
Describe un producto, proporciona una foto fija como fotograma inicial y deja que el modelo lo anime en 4K con audio ambiental sincronizado o estilo voz en off. El conocimiento del mundo del modelo mantiene las etiquetas y el texto del empaque legibles en cada fotograma, eliminando un punto débil común en vídeos de productos generados por IA.
Continuidad de personajes impulsada por referencias
Carga hasta diez imágenes de referencia de un personaje o ubicación para dirigir la generación. Gemini Omni Flash 1.1 mantiene la identidad visual consistente en los cortes, lo que la hace práctica para secuencias de estilo guión gráfico, mascotas de marca o configuraciones de escena recurrentes que deben verse igual en cada toma.
Edición de un clip existente por instrucción
Carga un vídeo de origen e introduce una instrucción de edición en lenguaje natural como «hacer el cielo nublado» o «eliminar el desorden del fondo». El modelo aplica el cambio sin un paso de composición separado, útil para rondas de revisión rápida en metraje que de otro modo estaría terminado.
Gráficos de movimiento con superposición de texto
Dado que el modelo se basa en el conocimiento del mundo de Gemini, el texto en pantalla se renderiza correctamente y se mantiene nítido durante el movimiento. Úsalo para títulos cinéticos, tercios inferiores o llamadas de datos donde otros modelos generativos típicamente producen formas de letra distorsionadas o desplazadas.
Secuencias de historia de imagen a vídeo
Proporciona una imagen inicial y un fotograma final opcional para definir los primeros y últimos momentos de una escena, luego deja que el modelo interpole la acción entre medias. Funciona bien para presentaciones de conceptos, animáticas y presentaciones de pitch donde necesitas movimiento controlado a partir de ilustraciones estáticas.
Ideas de prompts para probar
Por qué los creadores usan esta app
- Audio sincronizado nativo
- Salida de 360p a 4K
- Duración de 3-10s
- Entrada de texto, imagen y referencia
- Dirección con video de referencia
- Edita un video mediante instrucciones
Consejos para mejores resultados
Ancla el texto con un aviso
Cuando tu vídeo necesita palabras legibles, deletréalas exactamente en el aviso. Gemini Omni Flash 1.1 se basa en el conocimiento del mundo, lo que le da una ventaja en la precisión de las formas de letra, pero un aviso explícito aún reduce la desviación y asegura que el modelo priorice ese elemento.
Usa el fotograma final para control
Proporcionar tanto una imagen inicial como un fotograma final le da al modelo dos puntos de anclaje para interpolar entre ellos. Esta es la forma más confiable de controlar el arco y la composición cuando necesitas un resultado visual específico al final del clip en lugar de movimiento abierto.
Estratifica las entradas de referencia estratégicamente
El modelo acepta hasta diez imágenes de referencia y tres clips de referencia simultáneamente. Usa las ranuras de imagen para la consistencia de personajes u objetos y las ranuras de clip para definir el estilo de movimiento o el comportamiento de la cámara. Mezclar ambos tipos de entrada en una generación te da un control más fino que cualquiera de ellos solo.
Escribe instrucciones de edición con precisión
Cuando uses el modo de edición de vídeo, describe qué cambiar y qué preservar en la misma instrucción. Una frase como «cambia el color de la pared a azul profundo, mantén los muebles e iluminación idénticos» es mucho más efectiva que una directiva vaga, porque establece restricciones explícitas tanto en la edición como en los elementos sin cambios.
Cuándo elegir esta app
Elige esta aplicación cuando tu prioridad es resolución 4K con audio sincronizado nativo desde un único paso de generación, continuidad visual controlada por referencias en múltiples activos, texto legible en pantalla o la capacidad de editar un clip existente mediante una instrucción escrita. Seedance 2.5 cubre ejecuciones más largas de hasta 30 segundos y acepta mucho más material de referencia, lo que es un mejor ajuste cuando la duración o la profundidad de referencia importan más que el nivel de resolución. Wan 3.0 ofrece vídeo de paso único de 30 segundos con referencia omni, lo que lo convierte en la opción más fuerte para escenas extendidas. Gemini Omni Flash 1.1 es la opción correcta cuando necesitas la resolución de salida más alta de las tres, o deseas revisar un clip existente escribiendo una instrucción en lugar de regenerarlo.
Preguntas frecuentes
¿Puedo generar vídeo sin proporcionar ninguna imagen?
Sí. La aplicación acepta solo un aviso de texto. Las imágenes, fotogramas finales, imágenes de referencia y clips de referencia son todas entradas opcionales. Solo necesitas proporcionarlas cuando deseas dirigir la continuidad visual, definir puntos finales de movimiento o hacer coincidir un personaje o ubicación específica con tu material de origen.
¿Cómo funciona el audio sincronizado nativo en la salida?
Gemini Omni Flash 1.1 genera audio como parte del mismo paso del modelo que produce el vídeo, por lo que el sonido se sincroniza con los elementos visuales en lugar de agregarse como una pista genérica después. El MP4 resultante incluye el canal de audio ya integrado, listo para usar sin un paso de mezcla separado.
¿Cuál es el número máximo de entradas de referencia que puedo proporcionar?
Puedes proporcionar hasta diez imágenes de referencia y hasta tres clips de vídeo de referencia en una única generación. Estas entradas dirigen el modelo hacia la identidad visual consistente para personajes, objetos, ubicaciones o estilo de movimiento de cámara, dependiendo de lo que representen las referencias.
¿Funciona el modo de edición de vídeo en cualquier clip cargado?
El modo de edición toma un vídeo existente como origen y aplica una instrucción en lenguaje natural para modificarlo. El modelo interpreta el lenguaje natural, por lo que no necesitas especificar parámetros técnicos. Los resultados son más consistentes cuando la instrucción establece claramente tanto qué debe cambiar como qué debe permanecer igual.
¿Qué resolución debo elegir para entrega en redes sociales o web?
Para la mayoría de plataformas sociales, 1080p es un valor predeterminado práctico porque equilibra la calidad visual con el tamaño del archivo y los requisitos de carga. Usa 4K cuando el destino lo admita, como una demostración de pantalla de alta resolución o una plataforma que reduce la escala con elegancia desde una fuente más alta. 720p es adecuado para vistas previas o borradores. 360p es útil para iteración rápida antes de comprometerse con una resolución final.
¿Cómo mantengo un personaje consistente en múltiples generaciones separadas?
Guarda tus imágenes de referencia de una generación y proporcionalas como entradas de referencia en la siguiente. El modelo acepta hasta diez imágenes de referencia por ejecución, por lo que puedes incluir múltiples ángulos o expresiones del mismo personaje para reforzar la consistencia. Combinar referencias de imagen con un aviso descriptivo que nombre los rasgos distintivos del personaje mejora aún más la coherencia.
¿Qué modelo de IA impulsa esta app?
Esta app funciona con Gemini Omni Flash 1.1, disponible a través de Arteza sin cuenta separada ni configuración.
¿Puedo usar los resultados comercialmente?
Sí. El contenido que generas es tuyo para usar, sujeto a nuestras licencias de contenido.
¿Cuánto tiempo tarda una generación?
La mayoría de generaciones se completan en menos de un minuto, y puedes ver el progreso en vivo en la galería.