工作原理
1
编写镜头
好的视频提示词需要涵盖四个要素:主体、动作、场景和摄像机。描述一个手持摄像机跟随骑自行车的人穿过雨中街道,比仅仅提到骑自行车的人能给模型提供更多信息。
2
选择模型和设置
选择引擎、时长和宽高比。每个模型卡片都显示实时额度成本,所以你在提交前就能准确了解一个视频片段的成本。
3
生成、对比、剪辑
视频片段在几秒到几分钟内生成,具体取决于所选模型。用第二个引擎重新运行相同提示词来对比效果,然后将最好的片段组合成更长的编辑。
您可以立即使用的模型
以下每个模型均在Arteza上可用,并显示其当前积分成本,该成本来自工作室在生成时的定价引擎。
常见问题解答
我应该从哪个文本生成视频模型开始?
如果场景需要对白和1080p输出,选择Veo 3;如果需要更长的镜头和逼真的物理效果,选择Sora 2;如果需要精美的电影级片段和原生音频且成本更低,选择Kling 3.0 Pro;如果需要对构图和宽高比进行精细控制,选择Seedance 2.0。这四个模型都使用同一个Arteza额度账户。
视频可以有多长?
这取决于模型:大多数引擎每次生成大约4到10秒,Sora 2最长可达20秒。对于更长的作品,创作者可以生成多个镜头并将其组合在一起,或者延长一个几乎足够长的片段。
视频包含声音吗?
在某些模型上可以。Veo 3、Kling 3.0 Pro和Seedance 2.0在生成视频时会生成原生音频,Veo 3还额外支持同步对白。其他模型仅输出视频,适合在编辑中添加音乐或旁白的工作流程。
文本生成视频需要多少成本?
每个模型都有自己的每个片段或每秒额度成本,在此页面和工作室中生成前会实时显示。注册时你会获得免费额度,可以在花费任何费用前测试提示词。