获得 1 天 Seedance 2.5 无限使用权及更多内容最低享受 25% 折扣

折扣将在 -- 后过期

用此应用创建

Arteza 上的 Gemini Omni Flash 应用生成 720p 分辨率的短 MP4 视频,每个视频片段都自动内置同步音频,无需单独的音频处理步骤。它接受纯文本提示、单个参考图像或最多十个参考图像直接绑定到提示中,并支持对现有素材进行单次视频编辑。该应用专为需要在一次生成中获得带声音的社交就绪视频的创意工作者而设计,从产品预告到叙事片段再到快速场景修改均可满足。

如何使用此应用

  1. 1

    描述您想创建的内容,或上传您的源文件。

  2. 2

    选择您的选项,然后按生成。

  3. 3

    观看您的结果在片刻内显示在图库中。

  4. 4

    下载、分享或用新想法再次生成。

你可以创作的内容

具有即时音频的社交片段

由于 Gemini Omni Flash 会自动为每个视频生成同步音频,你可以在一次生成中为 Instagram Reels 或 TikTok 制作完整的带声音片段。无需寻找音乐或在后期添加旁白,音频在渲染时已嵌入其中。

参考驱动的品牌场景

上传最多十张参考图像(如产品照片、情绪板或角色设计),并将它们内联绑定到提示中。Gemini Omni Flash 使用这些视觉素材来锚定生成的场景,在整个片段中保持颜色、主体和样式的一致性。

单次视频编辑

将现有视频片段与文本指令一起输入应用,Gemini Omni Flash 在一次生成中重写指定的元素。这对于交换背景、调整光线氛围或改变角色动作非常有用,无需重新拍摄或多步工作流程。

快速叙事片段

对于需要 3 到 10 秒建立镜头且带环境音的故事讲述者(如下雨街道、运动中的工作室或人群场景),该模型从纯文本描述生成完整的视听时刻,可直接用于更大型的编辑中。

图像转视频动画

提供单张静止图像和动作提示来为照片、插图或产品渲染添加动画。Gemini Omni Flash 添加运动和匹配的音景,将静态资产转变为适合演示或社交媒体的短视频。

提示词灵感

创意工作者为什么使用此应用

  • 原生同步音频
  • 文本、图像和参考输入
  • 单次视频编辑
  • 最多10个参考图像
  • 3-10秒时长
  • 720p输出

获得更佳效果的技巧

描述你期望的音频

尽管音频是自动生成的,但在提示中命名你想要的声音(如雨声、人群低语或机械嗡鸣)可以引导 Gemini Omni Flash 生成更合适的音景。模糊的提示会生成通用音频,而具体的提示会生成有意图的音频。

充分利用全部十个参考槽位

该模型接受最多十张内联绑定的参考图像。进行品牌或角色工作时,提供多个角度和光照条件而非单张图像。更多视觉背景信息可以帮助模型更好地保持生成片段的一致性。

匹配片段长度与内容

应用支持 3 到 10 秒的时长。对于节奏紧凑的产品特写或单一动作,设置较短的时长(约 3 到 5 秒)。对于需要时间展开和让音频充分发展的建立镜头或场景,使用 7 到 10 秒。

精确编写编辑指令

对于单次视频编辑,明确指定什么改变以及什么保持不变。诸如「用森林替换背景,保持主体的动作和服装完全相同」这样的提示为模型提供了明确的约束,并减少了对你想保留的元素的意外更改。

何时选择这个应用

当你的视频需要从第一次生成就具有可用音频时,选择此应用。Seedance 2.0 和 Sora 2 等兄弟应用产生视觉效果强劲的素材,但不会原生生成同步音频,意味着你需要单独处理声音。Gemini Omni Flash 还通过其十图参考绑定功能脱颖而出,这为品牌一致或角色特定的场景提供了比 Seedance 2.0 Mini 或 LTX-2 Pro 更强的视觉锚定能力。

常见问题

我可以控制音频的声音效果,还是它总是自动的?

音频总是与视频一起自动生成的,没有单独的音频混音器或上传字段。但是,在文本提示中包含描述性音频线索(如具体声音、环境设定或相对音量描述符)会对 Gemini Omni Flash 的生成产生有意义的影响。

我应该如何在提示中格式化多张参考图像?

你可以在生成前在 Arteza 提示界面中直接附加最多十张图像。该模型将所有附加的图像作为场景的绑定参考。在文本提示中标记或描述每张图像的作用,例如「参考 1 是产品正面,参考 2 是产品背面」,以帮助模型正确使用它们。

单次编辑功能接受哪些类型的源视频?

应用接受现有视频片段作为输入,并配合文本编辑指令。你描述想要的更改,Gemini Omni Flash 在一次生成中应用它。输出是反映编辑内容的新 720p MP4,音频已重新生成以匹配修改后的场景。

720p 分辨率足以用于专业用途吗?

720p 非常适合社交媒体平台、网页嵌入、演示和原型设计。如果你需要 1080p 或更高分辨率的输出用于广播或大幅面显示,可以考虑使用 Sora 2 Pro 等兄弟应用,它面向更高保真输出。

我可以生成的最长片段是多长?

Gemini Omni Flash 支持每次生成 3 到 10 秒的片段。如果你需要更长的序列,可以生成多个片段并在视频编辑器中将它们剪辑在一起。单次编辑输出也在相同的 3 到 10 秒窗口内。

我可以仅使用纯文本提示而不使用任何图像吗?

可以。图像是可选的。当没有图像附加时,应用以文本转视频模式工作,从你的书面描述单独生成完整的场景、动作和音频。添加图像会根据是否包含源视频,将应用转换为图像转视频或参考转视频模式。

哪个 AI 模型驱动此应用?

此应用运行 Gemini Omni Flash,通过 Arteza 提供,无需单独账户或设置。

我可以商业使用结果吗?

可以。您生成的内容属于您,可以根据我们的内容许可证使用。

生成需要多长时间?

大多数生成在一分钟内完成,您可以在库中实时观看进度。

探索更多应用