历史对决 · 2025-06-15 UTC
Video Generation 对决 — 2025年6月15日
来自Video Generation类别。 24个标记分布在9个参赛者中。 Runway ML夺得桂冠。
最终排名
阵容
参赛工具
参加这场对决的每个工具的简介,按最终得分排序。

Runway ML 是一个基于 AI 的创意套件,用于生成视频、图像和多媒体编辑。它提供了范围广泛的工具和模型以模拟世界,包括 General World Models(GWM)用于机器人学、交互式世界模拟以及实时视频代理。该平台具有 Gen-4.5 高级视频模型用于生成高质量、精确控制运动、遵循指令、以及视觉一致性的视频。Runway 的工具用于各种行业,包括媒体和娱乐、机器人学和自主系统、以及建筑设计。该公司与领先的组织合作以推进自己的行业,并正在建立能够模拟所有可能世界和体验的基础 General World Model。
标准细分
- 文本到视频和图像到视频的生成
- AI 绿幕和背景移除
- 视频中的填充和对象移除
- 运动跟踪和摄像机控制
- 基于浏览器的协作式编辑器
- 对可训练和预建的 AI 模型的图书馆

Steve AI 是一个在线视频制作平台,能够将文字内容、脚本和音频文件转换为完整视频。它支持多种输出风格,包括实景生成式 AI 影像和传统动画格式,适合需要快速视觉输出的市场营销人员、教育者以及内容创作者。 用户可以粘贴剧本或上传音频,选择视频风格,并让系统自动匹配场景、角色和配音。编辑器随后允许手动调整场景、素材、音乐和节奏,然后导出。 它旨在将典型的视频制作工作流程压缩为一个基于浏览器的工具,消除对单独动画、配音和编辑软件的需求。
标准细分
- 文本到视频和脚本到视频生成
- 音频到视频转换
- 生成式 AI 和动画风格选项
- 自动场景和角色匹配
- 内置配音和音乐库
- 拖放场景编辑器
Moovly 是一个在线视频创作平台,结合了拖拽式编辑和 AI 工具,帮助用户制作动画视频、演示文稿和营销内容。它提供了大量模板、库存媒体和可定制资产,适用于企业、教育工作者和内容创作者。 该平台集成了 AI 功能,如文本转语音、基于脚本的自动视频生成以及翻译,帮助团队在无需专业设计技能的情况下扩大内容生产。完成的视频可导出为多种格式,或直接分享至社交和学习平台。 Moovly 也支持协作和品牌管理,使其适用于需要持续制作培训、说明或宣传视频的组织。
标准细分
- AI 文本转视频
- 语音合成
- 拖放式视频编辑
- 模板和标准媒体库
- 品牌套盒和团队协作
- 多格式输出和分享

Rask AI 是一个视频本地化平台,使用 AI 生成的语音将内容翻译、转录并配音成 130 多种语言。创作者、营销人员和教育工作者可以上传视频,快速生成同步音频、字幕以及可选的语音克隆版本,以保留原始说话者的语调。 该工具旨在扩大全球内容分发,无需为每个市场雇佣翻译人员或配音演员。它支持常见的视频格式和平台,提供多说话人检测、lip-sync、可编辑的字幕等功能,让团队在导出前可以对输出进行细调。
标准细分
- AI 配音在 130+ 种语言
- 从源音频中克隆声音
- 自动字幕化和字幕
- 多人音频识别
- 唇动同步视频输出
- 直接从 YouTube 和文件上载

DomoAI 是一款 AI 驱动的创意平台,能够生成风格化的艺术作品并将视频转换为动画格式。它特别擅长将照片和素材变成动漫、卡通及其他插画风格,深受业余爱好者和社交媒体创作者的喜爱。 该工具支持通过文本提示进行图像生成以及视频对视频的转换,用户可以用多种艺术风格重塑现有剪辑。它可以通过 Discord 与 Web 界面使用,降低了没有传统动画技能用户的使用门槛。
标准细分
- 文本到图像艺术生成
- 视频到动画转换
- 多种动漫和卡通风格
- 图像到图像重新渲染
- Discord 机器人集成
- 基于网页的仪表盘
FlowMetr 是为自动化团队设计的监控中心,提供工作流和集成的实时可视化。它帮助团队跟踪和分析自动化流程的性能,识别问题并优化工作流。FlowMetr 可能支持多种集成类型,并提供工作流健康状态的统一视图。不过,具体功能如警报、报告或支持的自动化平台目前尚未明确。总体而言,FlowMetr 旨在提升自动化工作流的可靠性和效率。
标准细分
- 跨平台自动化监控
- 实时故障和异常警报
- 运行历史和执行日志
- 统一状态仪表板
- 集成 Zapier、Make、n8n 等平台
- 通过 Slack 和电子邮件进行团队通知


Face Swap AI 是一款在线工具,可让用户使用先进的 AI 技术在照片和视频中换脸。它允许用户通过上传视频、选择面部并下载结果,以用户友好的界面创建高质量的换脸效果。该工具面向希望为社交媒体、广告和个人项目制作吸引人内容的创作者。它支持多面换脸、4K/HD 视频导出,并提供多种定价方案以满足不同用户需求。Face Swap AI 使用面部识别和融合算法生成逼真效果,用户可在无隐藏限制的情况下将生成内容用于商业用途。
标准细分
- 在视频和照片中进行换脸
- AI 驱动的面部识别与融合算法
- 支持多面换脸
- 4K/HD 视频导出
- 生成内容的商业许可证
- 用户友好界面


FaceswapFree 是一款完全免费的 AI 脸部替换工具,在线使用,无需注册。它支持直接在浏览器中对视频、照片和 GIF 进行换脸。该工具使用无限制,处理后的文件不带水印。它拥有简洁直观的界面,处理速度极快,无需任何技术技能。FaceswapFree 支持多种媒体格式,包括最大 500 MB 的视频和最大 2 MB 的 GIF,并且可以在视频的前 5 秒内进行换脸。工具确保用户文件的安全,文件仅对用户可见,不会被存储在服务器上。 界面平滑引导用户完成换脸过程,AI 在后台处理一切。整个流程从上传媒体、选择要替换的脸部开始,剩下的交给工具。FaceswapFree 提供一站式的换脸解决方案,是想玩自拍、制作病毒梗图或仅仅测试视频创意的用户的便捷可靠选择。
标准细分
- AI 驱动的自动人脸检测
- 照片人脸替换
- 视频人脸替换
- 动态 GIF 人脸替换
- 无水印下载
- 基于网页,无需安装


Pictory AI 是一款基于云的视频创建平台,能够在无需编辑经验的情况下将文字内容转换为精美视频。用户只需粘贴博客文章、剧本或其他文字内容,工具便会自动挑选相关库存素材,添加字幕,并同步配音,最终生成成品视频。 Pictory 面向营销人员、课程创作者和内容团队,帮助他们将现有素材重新包装成适用于社交媒体、YouTube 和内部培训的格式。除了文本转视频,Pictory 还提供将长视频摘要成精彩剪辑、自动字幕和品牌模板的工具。
标准细分
- 将文章或剧本转换成视频
- 将长视频转换成短片
- 自动添加字幕和编辑日志
- 使用多种语言和口音生成 AI 语音
- 自定义品牌套件
- stock 媒体库和模板选项














