历史对决 · 2024-06-12 UTC
AI Detection 对决 — 2024年6月12日
来自AI Detection类别。 32个标记分布在8个参赛者中。 Seedance 4.0夺得桂冠。
最终排名
阵容
参赛工具
参加这场对决的每个工具的简介,按最终得分排序。


Seedance 4.0 是一款基于网页的 AI 视频生成服务,可根据文本提示或静态图片生成短片。它面向创作者、营销人员以及希望在不进行传统拍摄或剪辑的情况下制作适用于社交平台或营销活动的视频的小型团队。用户输入提示词或上传图片,设置宽高比、分辨率和时长等参数,然后在几秒钟内生成视频片段。 该工具提供文本到视频和图像到视频两种模式。文本到视频模式下,书面描述会被扩展为动作、构图和视觉细节;图像到视频模式则将静态图像动画化,加入运动和摄像机动态。输出选项包括 720p HD 与 1080p Full HD,剪辑时长为 5 秒或 10 秒,并提供多种 aspect ratios,覆盖横向、纵向和方形等适配不同平台的格式。 该服务的一个显著特点是它充当多个底层生成模型的聚合器。除了自家的 "Seedance" 与 Seedream 模型外,付费套餐还宣传可使用第三方模型,如 Google 的 Veo 3、OpenAI 的 Sora 2,以及 Wan 2.5,用户可以在不同场景下切换模型。平台名称暗示与字节跳动的 Seedance 系列模型有关,但该站点似乎是第三方包装,而非官方字节跳动产品。 所述工作流程包括选择生成器、提供提示词或图像、生成并下载,然后细化运动、颜色和时序。额外面向创作者的功能包括内置音频(对白和环境音)、在完整渲染前的快速预览、批量任务、场景拆分、提示词助手、AI 视频增强器以及背景移除器。该服务强调商业使用许可证,允许将输出用于付费广告、客户项目和变现渠道。 定价采用积分制,并分为 Basic、Professional 和 Enterprise 三个层级,可按月、按年或一次性付款,积分对应每月的视频上限。许多更高级的权益——如访问 Veo 3、Sora 2、Wan 2.5、优先排队、无水印以及优先支持——仅在年付情况下开放。新用户可获免费积分以试用服务。 和大多数面向消费者的 AI 视频站点一样,潜在用户应将营销宣传与实际产出对比考虑:短视频时长、积分消耗以及对第三方模型的依赖导致结果和可用性可能存在差异。该站点的大幅折扣倒计时和限量名额提示是此类产品的常见做法,建议先使用免费积分进行试用,再决定是否订阅套餐。
标准细分
- 文本转视频和图像转视频生成
- 720p 和 1080p 的输出可选择宽高比
- 每个场景都可选中不同的模型
- 内置音频(对话和环境音效)
- AI 视频增强器和背景移除
- 批量作业,场景切割和提示助手


小飞龙(Xiaofei Li)是由字节跳动(ByteDance)开发的一款AI视频生成模型,旨在根据提示直接生成高质量的短视频内容。它支持原生2K分辨率输出,能够在无需依赖后处理超分辨率的情况下实现更清晰的视觉效果。 该模型专注于连贯的多镜头叙事,允许创作者构建人物、场景和基调在不同镜头之间保持一致的序列。它还会为视觉内容生成同步音频,包括环境音和对话时机,以便成品剪辑在初始制作完成后感觉更加完整。 它针对需要快速生成电影风格短片的内容创作者、营销人员和讲故事的人,他们无需组建单独的视频和音频制作流程。
标准细分
- 原生 2K 视频生成
- 合理的多镜头故事
- 音视频同步输出
- 基于提示的场景创作
- 角色和设置一致性
- 电影级视觉风格化

Altxt AI 是一款基于网页的工具,能够自动生成 alt 文本——为图像附加的描述文字,帮助提升无障碍访问和搜索引擎索引。它针对一个常见但繁琐的问题:拥有大量图像库的网站缺少适当的描述,影响屏幕阅读器的无障碍体验和在 Google 图片中的可见度。用户无需逐一手工编写描述,只需上传图片或粘贴图片 URL,即可在数秒内获得可直接粘贴的 alt 文本。 该工具面向博主、电子商务店主、开发者、房地产经纪人以及任何管理图像繁多页面的人。它利用视觉模型识别图像中的物体、人物、动作、颜色、文字和场景语境,并生成简洁的自然语言描述。其突出特点是 SEO 定向:用户可以提供可选关键词,使生成的文本具备关键词感知且与页面内容相关,而不是仅仅是通用标题。 Altxt AI 强调低摩擦的工作流程。使用基本生成器时无需注册、登录、电子邮件或信用卡——只需在浏览器中打开,上传多张图片(PNG、JPG、GIF 或 WebP,单张不超过 16MB),可选添加 SEO 关键词并选择输出语言后即可生成。生成的内容可直接复制到图片的 alt 属性。该网站还在生成器旁提供“Alt Scanner”,并支持多语言输出。 对于有积压任务的团队,批量上传功能可以一次性处理多张图片,定位为快速消除可访问性缺口并解决 SEO 审核警告的方式。供应商声称采用多层验证来确保准确性和可读性,输出符合 WCAG 标准,并且描述避免幻觉式细节——但与任何 AI 视觉工具一样,输出质量仍需核实,尤其对于细微或特定领域的图像。 与手动编写 alt 文本或内置 CMS 可访问性检查器相比,Altxt AI 的优势在于批量处理的速度和便捷性。其权衡点与自动描述工具的典型情况相符:生成的文本仍可能需要人工审核以确保准确性和语气;它以独立网页工具形式运行,而非原生 CMS 集成;以及 SEO 效益取决于合适的关键词输入和准确的图像识别。
标准细分
- 基于视觉模型的图像分析,识别对象、场景和上下文
- 可选的SEO关键词输入,用于关键词感知的替代文本
- 批量上传多个图片(PNG/JPG/GIF/WebP)
- 图片网址输入以及直接上传
- 多语言描述输出
- 生成器旁的替代文本扫描器


Face Shape Detector 是一款免费、基于网页的工具,可分析你的面部照片并将其归类为七种已知的脸型之一:椭圆形、圆形、方形、心形、菱形、长方形或三角形。随后,它会将检测结果转化为实用的造型建议——包括发型、眼镜框、妆容修容以及胡须的推荐,均依据你的面部比例量身定制。该工具解决了使用卷尺手动测量脸型的猜测难题,实现了在一分钟内完成的自动化分析。 工具基于 Google 的 MediaPipe 人脸关键点技术,能够在上传的图像上映射 478 个面部关键点。通过这些关键点测量额头宽度、颧骨宽度、下颌线宽度以及整体脸长,并计算区分不同脸型的比例关系。结果会以每种脸型的置信度分布形式展示,而非单一二元答案,从而让用户了解面部与各类脸型的匹配程度。值得注意的是,所有分析均在浏览器本地完成,照片永不上传至服务器或存储,较之需要远程处理的工具提供了显著的隐私优势。 使用方式非常简便:上传 JPG、PNG 或 WebP 格式的图片,或直接使用设备摄像头拍摄,系统约在 30 秒内返回结果。建议使用光线均匀、正面、头发束起的清晰照片以获得最佳准确度。无需注册、邮箱或付款,且可在手机、平板和桌面端直接使用,无需安装应用。 该工具面向日常用户,帮助他们了解自己的脸型以进行造型决策——如选择新发型、挑选眼镜框、学习妆容修容或决定胡须风格。它属于同一开发者提供的浏览器美容与造型工具套装的一部分,还包括眼型检测、面部对称性测试、色彩季节分析、身形计算器和唇形分析等功能。 主要优势在于隐私保护、快速响应、零成本以及基于业界认可的关键点检测库。局限性则属于此类工具的固有问题:脸型分类本身带有主观性,且受照片角度、光线和发际线可见度影响,结果可能因照片而异;造型建议为通用指导,而非专业定制;工具的准确度高度依赖输入图像质量。
标准细分
- AI 脸型检测,涵盖七种分类
- 通过 MediaPipe 实现 478 点面部关键点映射
- 本地浏览器内处理,无需上传至服务器
- 为每种脸型提供置信度细分
- 提供发型、眼镜、妆容及胡须的推荐
- 支持照片上传或实时摄像头捕获

GenFreeAI 可能是一个免费的聚合平台,旨在将多种 AI 工具集中在同一处,为用户提供一个方便且统一的入口来访问各种人工智能工具。该服务致力于简化发现和使用 AI 工具的过程,让个人能够更轻松地利用 AI 的优势,而无需在多个网站或平台之间来回切换。GenFreeAI 通常适用于希望探索和使用 AI 能力、但又不想承担高额费用或复杂操作的个人和组织。平台可能拥有用户友好的界面,用户可以浏览并挑选一系列拥有各自独特功能和应用场景的 AI 工具。不过,由于缺乏更具体的信息,难以准确界定 GenFreeAI 的具体功能、能力和限制。作为一个免费聚合平台,GenFreeAI 在 AI 工具的深度和广度方面可能存在局限,并且可能对使用或支持有一定限制。尽管如此,GenFreeAI 仍能为想要初步尝试 AI 或补充现有 AI 能力的用户提供显著价值。平台将多种 AI 工具集中在一起的能力有助于降低复杂度、提升效率并促进创新。通过提供免费且易于获取的 AI 工具聚合点,GenFreeAI 有助于实现 AI 的民主化,使更广泛的个人和组织能够受益于这些强大技术。不过,GenFreeAI 的实际能力和限制只能通过查阅平台文档或直接使用服务来确认。正如任何平台一样,务必仔细评估 GenFreeAI 的功能、能力和限制,以判断其是否满足您的具体需求和要求。与其他 AI 聚合平台相比,GenFreeAI 的免费和集中式方式在可访问性和便利性上可能具备优势,但在 AI 工具的深度和广度上可能存在不足。最终,GenFreeAI 的价值取决于用户的具体需求以及平台兑现承诺、提供高质量用户体验的能力。 GenFreeAI 的工作流和集成可能设计得用户友好且易于访问,让用户可以轻松浏览、选择并使用平台上提供的各类 AI 工具。然而,由于缺乏更具体的信息,难以确定 GenFreeAI 的工作流和集成的确切细节。 就优势和局限而言,GenFreeAI 的免费且集中式的方式可能是一个重要的优势,为用户提供了一个便利且易于访问的平台来探索和使用 AI 工具。然而,该平台在 AI 工具种类的深度和广度方面的不足,以及可能的使用或支持限制,可能会对部分用户构成显著的劣势。 总体而言,GenFreeAI 是一个有前景的平台,能够为希望利用 AI 红利的用户提供显著价值。不过,和任何平台一样,必须仔细评估 GenFreeAI 的功能、能力和局限性,以判断它是否满足您的具体需求和要求。 该平台对AI格局的潜在影响颇为显著,因为它能够帮助实现AI的民主化,让更广泛的个人和组织受益于这些强大的技术。然而,GenFreeAI的实际影响仍取决于平台能否兑现承诺并提供高质量的用户体验。 总之,GenFreeAI 是一个免费平台,旨在将多种 AI 工具聚合到同一个地点,为用户提供一个便利且集中的平台,以便探索和使用 AI 能力。虽然平台的局限性和潜在缺点需要慎重考虑,但 GenFreeAI 有望为用户带来显著价值,并对 AI 生态产生积极影响。 通过提供一个免费且易于访问的 AI 工具中心,GenFreeAI 可以帮助降低复杂度、提升效率并促进创新,使用户能够在不承担高额费用或复杂性的情况下利用 AI 的优势。然而,GenFreeAI 的实际功能和限制只能通过查阅平台文档或直接使用该服务来确定。 作为一个免费的平台,GenFreeAI可能会不断演进,定期新增AI工具和功能。这有助于确保平台对用户保持相关性和实用性,并能针对发现的限制或不足进行改进。 就使用 GenFreeAI 可能带来的风险和挑战而言,这些风险和挑战与使用任何 AI 平台或工具的情况大致相同。不过,该平台的免费且集中式的模式或许能在一定程度上降低这些风险,因为它为用户提供了一个便捷、易于获取的环境来探索和利用 AI 能力。 总体而言,GenFreeAI 是一个有前景的平台,具备为用户提供显著价值并对 AI 领域产生积极影响的潜力。不过,和所有平台一样,必须仔细评估 GenFreeAI 的功能、能力和局限性,以判断它是否符合您的具体需求和要求。 使用GenFreeAI的潜在收益非常显著,包括能够在不产生大量成本或复杂性的情况下利用AI的优势,以及降低复杂度、提升效率、促进创新的能力。不过,实际收益取决于平台是否能够兑现承诺并提供高质量的用户体验。 总之,GenFreeAI是一个免费的聚合平台,旨在将多种AI工具集中在同一地点,为用户提供一个便捷的集中式平台,以探索和使用AI功能。虽然平台的局限性和潜在缺点需要慎重考虑,但GenFreeAI有可能为用户带来显著价值,并对AI生态产生积极影响。
标准细分
- 一个仪表盘中的多个AI工具
- 文本生成工具
- 图像生成选项
- 生产力和写作助手
- 免费访问层级
- 适合初学者的界面

lupa ai 是一款基于 Web 的图像放大工具,使用机器学习技术在放大照片的同时保留细节并减少常见伪影,如模糊和像素化。它在浏览器中运行,用户可以上传图片,处理后下载增强后的结果,无需安装软件。 该工具面向需要快速修复低分辨率图像的普通用户,例如旧照片、社交媒体图形、产品图片,或需要额外清晰度的 AI 生成艺术。其免费层级适用于一次性任务,简洁的界面则让非技术用户也能轻松使用。
标准细分
- AI驱动的图像放大
- 浏览器端处理
- 细节和清晰度增强
- 支持常见的图像格式
- 免费在线访问
- 结果下载仅一键


Text Remover(removetextfromvideo.com)是一款基于网页的 AI 工具,旨在从视频素材中去除不需要的文字、字幕、说明文字、水印和叠加层。它针对视频编辑者和内容创作者的常见痛点:清理无法简单关闭的烧录或硬编码文字,同时避免手动遮罩或低质量工具常产生的模糊斑块或残影。 该服务完全在线运行,强调高保真修复,声称能够自然地重建被删除元素背后的背景,而不是对其进行涂抹或模糊处理。它旨在保持跨格式的原始帧率和分辨率,适用于 TikTok、Instagram Reels、YouTube Shorts 等短视频竖屏内容,也适合网络研讨会和档案视频等较长素材。 该工具的典型使用场景主要围绕再利用和本地化工作流。创作者在添加翻译字幕前使用它来去除已有字幕,营销机构在重新品牌化之前清除供应商或客户素材中的叠加层和水印,编辑则从档案素材中删除日期戳或标志。相较于在 Adobe Premiere 等编辑软件中逐帧遮罩,这一功能承诺能节省时间。 定价采用积分制,而非统一的订阅费用。一次性 Starter Pack 价格约为 6.90 美元,包含约 500 积分(相当于约五分钟视频,最长可生成六分钟片段,且在 30 天内有效),同时也提供月度和年度套餐。该工具在处理前会实时估算所需积分,并且不会在输出中添加自带的水印。 作为一款 AI 修补风格的工具,其效果会随素材而异:运动复杂、纹理背景或大面积覆盖的场景本身就更难以干净地重建,即使该工具在多数情况下表现良好,也可能出现幽灵效应或融合不完美的情况。对于处理大量长视频的用户来说,信用/时间限制模式以及按分钟计费也可能是需要考虑的因素。
标准细分
- AI使用硬编码文本和overlay的视频
- 字幕和字幕移除
- 水印和Logo移除
- 背景重建,避免模糊或品质损失
- 保持原有帧率和分辨率
- 实时积分估计


Image Location finder 是一款 AI 工具,能够分析照片以识别拍摄地点。它通过检查建筑、景观、标识、植被和光照等视觉线索,估计最可能的地点,并为用户提供验证过的目的地。 此工具对于想要回忆地点的旅行者、验证图片来源的研究人员、核查内容真实性的记者,或任何对照片中场景感兴趣的人都非常有用。用户上传一张图片,即可获得位置建议及相关背景信息。 它无需依赖嵌入的 GPS 元数据,适用于截图、社交媒体图片或已被删除 EXIF 数据的旧照片。
标准细分
- 基于人工智能的视觉场景分析
- 地标和建筑物识别
- 景观和环境匹配
- 不依赖于嵌入的GPS元数据
- 位置建议带有置信度上下文
- 基于浏览器的图片上传










