获得 1 天 Seedance 2.5 无限使用权及更多内容最低享受 25% 折扣
207 个应用
一键 AI 应用,支持图像、视频、语音和虚拟人物。选择应用,描述想法,将其变为现实。
文本生成图像
GPT Image 2.5 Flare 是快速配置,针对创意工作和社交媒体的大批量生成进行了高质量优化。编辑修改仅会改变您要求的部分,不会影响主体。
每次生成需要 1 个额度起
GPT Image 2.5 Sunburst以OpenAI的最高质量设置运行,因此需要更长的处理时间。专为需要经得起仔细审视的宣传素材和产品摄影而打造。
每次生成需要 4 个额度
图像生成视频
将一张照片变成延时摄影。观看白天变成夜晚、风暴滚滚而来或人群匆匆而过。
每次生成需要 3 个额度起
编辑图像
上传产品,看它被绘制成巨大的墙面涂鸦,包含品牌名称,拍摄其真实效果。
每次生成需要 1 个额度
文本生成视频
运行 MiniMax H3 最快且最便宜的方式,当您需要二十个版本而非一个时。480P 或 768P,五至十五秒。
每次生成需要 2 个额度起
音乐
选择一个风格,获得十五秒的完成乐器音乐。Trap、Lo-fi、House、预告片配乐、Jazz trio:十四种选择,无需乐器和人声。
创建视频
输入您的频道名称并选择字母的材质。生成四秒完整片头,包含音效,按您输入的方式精确拼写。
每次生成需要 6 个额度起
上传任何房间的照片,即可获得重新装修后的版本。墙壁、窗户和门的位置完全保持不变。
上传任何户外照片,选择喜欢的天空,系统将自动调整照片中所有元素的光线以匹配新天空。
上传一张菜肴的手机照片,选择拍摄场景。可以是菜单照片、昏暗的餐厅餐桌、俯视平铺、阳光露台。
上传服装在衣架、人模或平铺状态的照片,获得模特从头到脚穿着该服装的效果图,背景由您选择。
上传一张绘图,选择它应该由什么材料制成。一张照片、铬雕塑、彩色玻璃窗、油画。
上传您的标志,在T恤、咖啡杯或店铺门面上预览效果。您的设计原样展示,拍摄于其真实应用场景。
上传一张照片,从新的摄像机角度重新拍摄。同一主体,同一风格,全新视角。
上传一张照片,为其焕然一新。胶片颗粒、黄金时段、黑白、霓虹等效果,一键应用。
将一张静止照片转化为短视频。选择摄像机运动方式,观看画面生动呈现。
将雪花、烟雾、花卉或金箔融入你的照片。选择一个元素,它会以匹配的光线和深度呈现。
上传您的产品并将其放在专业级场景中。同一产品,新的背景,真实阴影。
上传您的产品,选择场景并输入标题。您将获得一张带有文字绘制在图像上的成品广告素材,尺寸适合社交媒体。
上传任何房间的照片,看它如何焕然一新。同样的房间,同样的墙壁,全新的风格。
上传房屋照片并重新设计外观。在您已拥有的同一栋房屋上,选择十二种外观和十二个花园。
上传您的汽车照片并重新设计样式。十二种车漆颜色和十二套轮毂与饰件,为您车道上的车量身定制。
上传您的手臂、肩膀或腿部照片,在您自己的皮肤上看到逼真的纹身。24 种黑色墨水、细线和彩色设计。
上传你的手部照片,在你自己的指甲上试试美甲。二十四种色调、质地和设计,就在你已有的手上。
上传任何照片,将您的主体放入新的场景中。二十四个精心选择且光线充足的背景,光线已调整以匹配您主体的光线。
上传您宠物的照片,看它成为皇室成员、宇航员或水彩画。始终是您的宠物,每次都是。
上传一张照片,看看自己变身油画、武士或盒装乙烯基玩具的样子。永远都能一眼认出是你。
上传一张照片,在自己脸上尝试二十四种化妆风格,从裸妆到完整妆容。照片中的其他部分保持不变。
上传照片,尝试新发型、新发色或新胡须。同样的脸孔,同样的照片,不同的发型。
上传照片,尽情试穿。同样的你,同样的姿态,不同的服装。
虚拟人
给一张照片一句台词和一个声音。它会在镜头前同步说出来。
将一张照片转变为 VFX 镜头。着火、冰冻、破碎或消散,而你仍在其中。
上传你们各自的照片,获得一张自然的双人合照,背景可自由选择。
上传一张人物照片和一张产品照片,即可获得一张自然的照片,显示他们拿着它。
上传一张人物照片和一件服装的照片,即可获得他们穿着该件服装的短片。
每次生成需要 10 个额度起
上传一张随手拍的照片,获得专业形象照。新衣服、新背景、专业打光,还是你的脸。
上传一张破损的老照片,获得修复后的副本。褶皱、撕裂和褪色消失了,面部保持不变,您选择风格。
将一张人物、宠物或喜爱物品的照片转变为模切贴纸。选择制作材料,从像素艺术到绣线,完美保留原本特色。
上传户外照片,获得同一地点在另一个季节的效果,叶子、地面和光线都会相应变化。
上传宠物、孩子或任何你喜爱事物的照片,获得可打印的着色页,具有清晰的轮廓和大片空白区域供填充。
上传你的照片,输入标题,获得完成的 16:9 缩略图,包含你的面部裁剪和足够大的文字以便在手机上阅读。
输入品牌名称,选择风格,数秒内获得精美徽标。
输入书名、选择风格,几秒内即可获得完成的书籍封面。
将一张产品照片转变为短视频广告。选择周围发生的动作,获得动态镜头。
让照片中的人物挥手、大笑或拥抱。选择一个动作,获得一段短视频。
选择场景,输入贺词,生成将文字融入卡片设计的艺术作品。
选择一种风格,获得全新的手机壁纸,精心设计让时钟静置在宁静之处。
上传你们的照片,获得一个短视频,记录你们拥抱、跳舞或击掌的瞬间。
上传你们各自的照片,获得一段你们共享温柔亲吻的短视频,从初吻到脸颊之吻。
上传你们各自的照片,看看你们可能拥有的宝宝,从熟睡的新生儿到咯咯笑的一岁宝宝。
上传你们各自的照片,获得你们两人的婚礼照片,从誓言到第一支舞。
上传一张自己的照片,获得节日风格的肖像 - 从树下穿着睡衣的样子到雪落在傍晚街道上的场景。
上传一张你自己的照片,获得万圣节服装肖像,从烛光南瓜房间到月圆之夜的雾蒙蒙补丁。
上传一张你的照片,获得生日肖像,从吹灭烛火蛋糕上的蜡烛到黄金时段的屋顶敬酒。
上传一张自拍照,即可获得毕业肖像——从阳光草坪上的学位帽抛掷,到宏伟大学台阶上的卷起毕业证书。
上传一张自己的照片,获得优雅的孕妇肖像——从柔和的摄影棚到金色时刻的飘逸礼服。
上传一张你的照片,获得一张旅行照片,穿着适合你选择目的地的天气服装。
上传一张照片,获得你的学校肖像,拍摄于你选择的任何年代。同一张脸,同一年龄,只是照片改变。
视频生成视频
上传一段视频,让它以另一种媒介呈现——绘画、涂色或建模。保留您的运动和构图,赋予其全新的视觉效果。
上传照片,进入方块世界。相同的发型、相同的颜色,由立方体构成。
上传照片,成为光滑塑料角色,出现在您选择的任何地方。
上传照片,以装甲状态回归,光照效果如同格斗游戏。保留您的面容。
上传照片,以格斗家的形象登场,光泽照耀,适合角色选择界面。
上传照片,成为寻宝行动的主角,在遥远的地方灰尘飞扬、阳光明媚。
上传照片,骑马进入西部世界。帽子、长外套、低垂的太阳和尘土。
上传照片,以特工身份回归,面部暴露在战场上。
上传照片,成为开放世界犯罪游戏的领头人。棕榈树、肌肉车和炙热的阳光。
上传照片,进入一个生活模拟。明亮的房间、干净的色彩以及每个房间都发生着一些事情。
上传照片,出现在角落里的摄像头中。广角镜头,褪色的色彩,从高处俯视。
上传照片,被偷拍。强烈的闪光灯,街道陷入阴影,以及一个无人时间校正的画面。
上传照片,站在预定墙前。平坦的光线、一面简单的墙和八种胶片底片。
上传一张照片,主演您的专属美食秀。选择菜品,餐桌为您设置好。
上传一张照片,登上舞台。每个场景都选择服装和灯光。
上传一张照片,把您的头放在马桶里。八个位置供马桶站立。
上传一张照片,获得房屋大小的动物群环绕。十六种动物供您选择。
上传一张照片,即可获得带有画框和所有细节的印刷版漫画页。有十六种绘画风格可供选择。
上传您的产品或徽标,它将以具有面部、手臂和腿的品牌角色形象呈现。有十六种材质可选。
选择一个场景,它会同时生成图像和声音:刀划玻璃、蜂蜜从勺子上流淌、水晶叮当。十六种不同的声音。
每次生成需要 4 个额度起
上传照片,坐在麦克风前。同样的脸,围绕它的一个工作室。
上传照片,捕捉到动作的顶端,装备齐全,悬浮在空中。
上传照片,以数百英尺的高度重返,在一个保持正常尺寸的世界中。
上传一张照片,让它变成街头艺术,被绘制在墙上并拍照留存。
上传一张照片,让它变成艺术家,在录音室拍摄用于新闻稿。
上传一张照片,潜入水中。头发飘动,衣服漂浮,光线从上方照下来。
上传产品照片,即可将该产品改造成其他材质。例如针织羊毛、塑料积木、抛光铬或剪纸,保持相同形状和角度。
选择一个场景,输入顶部的文字和底部的文字,即可获得带有文字直接绘制在图片上的表情包。
上传一张物体的照片,即可获得其技术图纸:三视图、尺寸线以及角落处的标题文字。可选择八种不同的绘图风格。
输入任何内容,获取其单个自定义表情符号,居中显示在纯色背景上,且足够简单,即使缩小到指甲大小也能清晰辨认。八种绘画风格,从光泽 3D 到十六像素艺术。
输入主题,获取其干净的剪贴画,从纯色背景中抠出,并可直接放入幻灯片、工作表或传单。八种插图媒介可供选择。
输入您的品牌或想法,获取一个网站图标:一个标记、正方形、无杂乱,旨在在浏览器将其缩小到十六像素时保持可读性。八种标记风格供您选择。
描述一个生物,从它那里获得原创的全身怪物设计,光照效果如同概念艺术。八种原型,从高耸的怪兽到袖珍的小恶魔。
选择一个传说中的生物,说明你的与众不同之处,并获得它的全身肖像图,背景是它自己的景观。八种生物,从龙到九尾狐。
描述一个角色,获得它的精灵肖像图,三分之二长度且光照效果如同角色表。八种族群:七个来自奇幻世界,还有一个是为十二月准备的工作室精灵。
描述你的角色,获得他们的人形化肖像,全身对着简单的背景。八种艺术风格,从干净的赛璐遮光到松散的水彩。
输入一种动物或物体,获得那些荒诞的融合生物,独立站立在纯色背景上。八种融合方式,从运动鞋到全身板甲。
描述一个角色,获得它的收藏艺术玩具照片,就像产品拍摄一样,背景为纯色。八种饰面,从柔软的毛绒到镜面铬。
输入一个词,选择字母的绘画方式,并将其作为墙上的作品呈现。
输入标题和详细信息,选择打印方式,获得每行都绘制好的完成传单。
输入标题和详细信息,选择印刷卡片,即可获得每行都精确绘制的邀请函。
输入标题和每行一个数字,选择图表,即可获得按比例绘制的扁平信息图。
上传一张照片,将其主体以相同的姿势和角度重建为扁平的多面体。
上传一张照片,获得一张卡通肖像:仍然可辨认出您,并将最突出的特征进一步夸大。
上传一张照片,以不同的配色方案获得它,保留形状、边缘和细节。
描述镜头,Seedance 2.5 将为您拍摄视频,音频已内置其中。最长 30 秒,1080p 分辨率,参考图像可确保角色全程保持一致。
每次生成需要 13 个额度起
描述场景,Seedance 2.0 将为您渲染 4K 视频并生成同步音频。这是用于最终发布的镜头级别。
每次生成需要 19 个额度起
Seedance 2.0 引擎优化版,出图更快,费用更低。最长 15 秒,内置原生音频,让您在确定方案前尝试五种不同的想法。
Wan 3.0 可在单次生成中渲染最长 30 秒视频,无需拼接长镜头。支持最多十张参考图像,或使用参考视频和音频轨道进行引导。
Wan 3.0 的高端层级,用于制作最终成片而非草稿。相同的 30 秒单次生成和十图参考功能,细节层次更丰富。
上传静止图像,Seedance 1.0 Lite 将瞬间为其添加运动效果。最长 12 秒,从 480p 到 1080p,支持固定摄像机模式以保持画面稳定。
上传静止图像,Seedance 1.0 Pro 默认以 1080p 分辨率为其做动画处理。结尾帧控制让您指定镜头的落点,而不仅是起点。
Seedream 5.0 Lite 在绘制前深思熟虑地理解详细描述,并能正确渲染文字。速度快的层级,适合草稿和大量生成。
Seedream 5.0 Pro 可理解复杂描述并用 14 种语言在图像中写入可读文字。还能修改单个元素而不影响其余部分。
每次生成需要 3 个额度
向 OmniHuman v1.5 提供一张照片和音频轨道,它将返回该人物说话的视频。唇形同步、表情和姿态均来自单张静止图像。
Gemini Omni Flash 生成与图像同步的音频,并可一次性编辑现有视频。用最多十张参考图像引导。
Gemini Omni Flash 1.1 渲染 360p 至 4K,具有原生同步音频。三至十秒,您可传递视频按指令更改。
MiniMax H3 接受最多九张参考图像,因此角色在镜头间保持一致。最高 4K,支持参考视频和音频引导及末帧控制。
MiniMax H3 Max 在十秒内返回五秒视频。480P 或 768P,五至十五秒,支持末帧控制。
FLUX 3 在 1080p 以原生音频保持单个镜头长达 20 秒。给定首帧和末帧,它填充中间的镜头。
每次生成需要 5 个额度起
Seedream v3 是可靠之选:支持引导控制、批量生成和可保存的种子值。需要明天再生成同一张图像时正好用到。
Seedream v4.5 可渲染最高 16 兆像素,达到印刷级别而非屏幕级别。一次批量生成多张,并保存有效的种子值。
FLUX.1 Schnell 在不到一秒内返回图像,仅需一到四步。用它来确定构图,之后再为细节付费。
FLUX.1 Dev 运行完整的 28 步并让您自行设置引导强度。这是提示词开始按照您本意运作的层级。
FLUX Pro Ultra 分辨率达 2K,细节丰富到支持放大查看。支持参考图像,许可证涵盖商业用途。
Z-Image Turbo 是这里最便宜的兆像素级方案,即刻返回结果。六种宽高比预设,为草稿和大量生成而生。
FLUX.1 Krea 经过调整以呈现摄影感而非生成感。自然光线和更少的 AI 痕迹,这正是人像和生活方式摄影所需。
Qwen Image 严格遵循提示词并在图像内正确拼写文字。这种组合正是海报和标识设计真正需要的。
MiniMax Image 追求鲜艳色彩而非克制,八种宽高比可选。速度快、价格低,足以填充整个内容日历。
Dreamina 3.1 构图如电影画面,具有深度和丰富细节。六种宽高比预设,专为概念艺术和营销视觉设计。
Grok Imagine 2K 分辨率的价格与 1K 相同,十三种宽高比可选。风格表现力强而非字面理解,适合社交媒体。
Google 的 Nano Banana 2 渲染达 4K,文字精准,绘图时可实时查询信息。一次运行即可生成多个变体。
Nano Banana Pro 基于 Gemini 3 Pro,对创意描述的理解最为直译。支持 4K,获得商业使用授权。
GPT Image 2 处理包含多个指令的提示词,文字渲染清晰。OpenAI 最新力作,覆盖广泛的风格和尺寸。
Recraft V3 导出真正的 SVG 矢量,而非栅格图伪装。专为 logo、品牌系统和在矢量编辑器中打开的资产设计。
Recraft V4 细节更锐利,紧密遵循设计创意。五种尺寸预设,针对产品照和品牌视觉优化。
Recraft 广告和印刷级别,文件需经得起放大。五种尺寸预设,包含品牌系统支持。
Recraft V4.1 是精化版本:边缘更清晰,提示词遵循度更高可靠。五种尺寸预设用于设计工作。
FLUX.2 保真级别,适合英雄图像和广告。六种尺寸预设,细节在全尺寸下依然清晰。
每次生成需要 2 个额度
ImagineArt 1.5 Pro 原生 4K 渲染,无需放大处理。九种宽高比,为逼真摄影调校。
Nano Banana 是 Google 的 Gemini 图像模型:擅长图片内的文字和对提示词含义的理解。十种宽高比,每次运行生成多张图像。
Ideogram V3 适合图像中文字必须精准的场景。为海报、营销和排版主导的作品设计。
Ideogram V4 排版渲染比任何早期版本都更可靠。快速模式用于草稿,质量模式用于要打印的海报。
GPT Image 1 遵循多步骤指令,可编辑上传的图像。风格多样,适合不断变化的创意需求。
ImagineArt 2.0 渲染前分析场景,因此光线表现逼真。专业级电影逼真度。
FLUX 2 Pro 是生产级别:照片级真实感、运行间一致性强、排版效果更好。需要时上传参考图像。
Midjourney V7 以其著称的美学风格生成,支持风格控制和多种宽高比。适合插画和概念艺术,而非文档类图像。
Nano Banana Lite 在两秒内回应,编辑效果与生成相同。十四种宽高比,您可以逐回合处理同一图像。
上传一张照片,在六岁、二十岁和六十岁时见到同一个人。同样的脸,同样的衣服,只有岁月在流逝。
上传图像并说明要进行的修改。Seedream v4.0 Edit 一次处理多张图像,是进行修改的最经济方式。
上传图像,用一句话描述改动。FLUX Kontext Pro 在编辑时保持人物和排版的一致性。
上传参考图像,Runway Gen-4 将根据其风格进行创作,而不仅仅依赖您的文字描述。1080p 输出,用于风格转移和营销视觉。
快速的 Runway 版本,用于探索多个参考图像间的风格变化。任意分辨率,按批次定价而非最终稿。
Seedance 2.0 最经济的层级,仍配备画面配音功能。最长 15 秒,支持可选结尾帧和参考图像以保持连贯性。
OpenAI 的 Sora 2 能精准理解长提示词并保持物理逻辑准确。最长 20 秒,支持从文本或上传的静止图像开始生成。
Sora 2 的真正 1080p 层级,用于制作主镜头而非陪衬素材。相同的 20 秒时长和文本/图像起点,细节表现力更强。
每次生成需要 18 个额度起
Pika 2.2 倾向风格化而非写实,这通常是社交媒体运动所需的效果。720p 或 1080p,七种宽高比选择,支持从文本或静止图像生成。
Kling 3.0 自动为画面配音并支持多镜头序列。五到十秒,支持从文本或静止图像生成。
每次生成需要 7 个额度起
Kling 3.0 的质量层级,专为客户工作而设。原生音频和多镜头序列,从书面场景或上传的帧生成。
每次生成需要 9 个额度起
Kling O3 能处理多个角色的场景,大多数模型在这方面表现模糊。支持语音输入或您自己的元素,五到十秒视频长度。
Wan 2.5 以非旗舰价格提供 1080p 质量,支持从文本或静止图像生成。运动表现力强,多功能性足以成为您首选的默认模型。
MiniMax Live 反应迅速,物理效果逼真,这正是草稿阶段所需。输入文本或图像,得到自然流畅的动作。
每次生成需要 8 个额度
Luma Ray 2 以真实摄影机运动方式移动镜头,具备真实景深效果。专为叙事镜头而非特效设计。
PixVerse v5.5 专为特效和转场而非逼真度设计。速度足够快,可在一次会话中以多种风格尝试创意。
Wan 2.6 用稍微降低的速度换取电影级动作质感,在运动表现中显而易见。文本或图像输入,结果变化明显增加。
Kling 动作质量配上草稿级价格。Turbo 从文本或静止画快速响应,是迭代的最佳选择。
Kling 2.6 Pro 在多镜头序列中保持动作连贯。电影级质量,从文本或静止画生成,价格低于旗舰版。
MiniMax Video 02 是物理效果不再显得错误的一代。角色动画表现不错,迭代成本低廉。
Wan 2.7 提供 Wan 系列中最平顺的动作,画面细节保持稳定。文本或图像输入,价格适合大量生成。
HappyHorse 1.0 在同一视频中实现电影级动作和多语言唇同步。当镜头中有人说话时,从文本或静止画开始。
每次生成需要 11 个额度起
Google 的 Veo 3 与画面同步生成对话和声音,而非事后添加。支持 1080p,动作质感如摄影机实拍。
每次生成需要 24 个额度起
Veo 3 保留原生音频,调整为更快返回和成本更低。在最终渲染前进行草稿的最佳选择。
每次生成需要 17 个额度起
Veo 3.1 渲染 4K 分辨率,包含语音对白。提供参考图像以保持一致性,可延伸场景而非重新开始。
每次生成需要 12 个额度起
Hailuo 02 Pro 拥有 Hailuo 系列中最强的物理效果和尾帧控制。设定镜头的起点和终点。
Hailuo 2.3 社交媒体量级定价。文本或静止画生成 6 或 10 秒视频,具备新代代的动作改进。
Hailuo 2.3 Pro 保持整个视频的动作连贯,不会出现漂移。当渲染结果就是最终版本时使用此级别。
PixVerse V6 动作更锐利,可选音轨。文本或静止画生成 1080p,适合社交媒体。
PixVerse V5 提供 1080p,价格适合试错。动作可靠,从文本或上传的帧开始。
Seedance 1.5 Pro 渲染 1080p,音频与画面同步。七种宽高比,可设定尾帧以确定镜头终点。
最快的 Seedance 级别,仍支持 1080p 的七种宽高比。专为仍在确定镜头效果的初稿阶段设计。
Veo 3.1 保留原生音频和 4K 分辨率,调整为更快返回。参考图像可确保镜头间风格一致。
最便宜的 Veo 3.1 入门方式,对白和音频完整。720p 或 1080p,参考图像确保风格统一。
xAI 的 Grok Video 快速且更倾向表达性而非字面意思。文本或图像生成 720p,这正是社交媒体所需。
Runway Gen-4.5 将镜头运动作为控制变量而非提示猜测。五至十秒,可从文本或静止图像生成。
上传照片,Wan 2.2 为其添加运动效果,运动多样性在该价位中堪称罕见。选择分辨率,并在需要时设置结尾帧确定镜头终点。
上传静止画,Kling O1 提供不同寻常的动作控制力。5 或 10 秒视频,可设定尾帧以确保镜头精准着陆。
上传一张照片,Grok Video 1.5 将其制成动画,包含音频。最高支持 720p,具有 Grok 系列产品以其表现力著称的动作效果。
上传静止图像,它会动起来而不失 Midjourney 风格。为风格本身是关键的动画而设计。
上传产品照或静止图像,Runway Gen-4 Turbo 快速制成动画。五至十秒的电影级动作,按迭代定价。
上传视频并用简单词语告诉 Kling O1 要进行的更改。替换角色、改变场景位置,或使用参考图像引导编辑。
每次生成需要 8 个额度起
上传最长 15 秒的素材并描述新的外观效果。Kling O3 将重新处理画面风格,而保持原音频完全不变。
Kling Avatar v2 可为卡通或动物做唇形同步,就像处理真人一样。任何角色类型,仅需一张图像和一份录音。
SadTalker 是快速验证头像想法是否可行的最廉价方式。一张照片、一个音频文件,加上表情控制。
上传现有素材和新的音频,Sync-3 将重写嘴形以匹配。4K 输出,支持任何角色风格,无需训练步骤。
Fabric 1.0 将照片和语音轨道转换为主持人,480p 或 720p 分辨率。视频时长将完全匹配您提供的音频。
Infini Talk 通过音频驱动头像,表情丰富度明显超过大多数同类产品。输入一张照片,输出 480p 或 720p 视频。
Wan 2.2 S2V 根据语音移动整个面部和头部,不仅是嘴部。一张照片加音频,480p、580p 或 720p 输出。
文本转语音
粘贴脚本并从 ElevenLabs 超过一百个十二种语言的声音中选择。调整情感和节奏,直到听起来像真人。
MiniMax Speech 2.8 HD 是用于出版级旁白的版本。最多 10,000 个字符的运行,支持多语言,情感可控。
快速、低成本的 MiniMax 声音,用于草稿和高产量旁白。最多 10,000 个字符的运行,支持多种语言。
音效
描述一个声音,ElevenLabs 返回清晰的二至二十二秒文件。脚步声、门响、房间环境音、过渡音效。
描述心情,Stable Audio 生成五至三十秒的音乐,无版权问题。任何风格,适用于广告或播客的配乐。
声音克隆
上传一个样本,ElevenLabs 构建一个您可以持续使用的声音。立即预览,然后用它叙述任何内容。
每次生成需要 23 个额度
语音翻译
上传音频,ElevenLabs 用同一声音以其他十种语言之一返回。表现力在翻译中保留。
每次生成需要 14 个额度起
音频清理
上传嘈杂录音,ElevenLabs 单独返回声音。房间噪音、交通声和嗡嗡声被移除,表现力保留。
变音
上传录音,ElevenLabs 用不同声音逐字返回。超过一百个目标声音,传达方式保持不变。
音色设计
用词语描述一个声音,MiniMax 构建它:年龄、口音、心情、角色。高清质量,您可重复使用。
每次生成需要 45 个额度
字幕
上传音频,Whisper 返回带时间戳的文本,加上准备好直接添加到视频的字幕文件。支持 99 种语言。
声音场景
描述整个场景而不仅仅是单句,Seed Audio 会演绎。用图像或参考录音引导,并重用您已克隆的声音。