最终排名
阵容
参赛工具
参加这场对决的每个工具的简介,按最终得分排序。


小飞龙(Xiaofei Li)是由字节跳动(ByteDance)开发的一款AI视频生成模型,旨在根据提示直接生成高质量的短视频内容。它支持原生2K分辨率输出,能够在无需依赖后处理超分辨率的情况下实现更清晰的视觉效果。 该模型专注于连贯的多镜头叙事,允许创作者构建人物、场景和基调在不同镜头之间保持一致的序列。它还会为视觉内容生成同步音频,包括环境音和对话时机,以便成品剪辑在初始制作完成后感觉更加完整。 它针对需要快速生成电影风格短片的内容创作者、营销人员和讲故事的人,他们无需组建单独的视频和音频制作流程。
标准细分
- 原生 2K 视频生成
- 合理的多镜头故事
- 音视频同步输出
- 基于提示的场景创作
- 角色和设置一致性
- 电影级视觉风格化

Altxt AI 是一款基于网页的工具,能够自动生成 alt 文本——为图像附加的描述文字,帮助提升无障碍访问和搜索引擎索引。它针对一个常见但繁琐的问题:拥有大量图像库的网站缺少适当的描述,影响屏幕阅读器的无障碍体验和在 Google 图片中的可见度。用户无需逐一手工编写描述,只需上传图片或粘贴图片 URL,即可在数秒内获得可直接粘贴的 alt 文本。 该工具面向博主、电子商务店主、开发者、房地产经纪人以及任何管理图像繁多页面的人。它利用视觉模型识别图像中的物体、人物、动作、颜色、文字和场景语境,并生成简洁的自然语言描述。其突出特点是 SEO 定向:用户可以提供可选关键词,使生成的文本具备关键词感知且与页面内容相关,而不是仅仅是通用标题。 Altxt AI 强调低摩擦的工作流程。使用基本生成器时无需注册、登录、电子邮件或信用卡——只需在浏览器中打开,上传多张图片(PNG、JPG、GIF 或 WebP,单张不超过 16MB),可选添加 SEO 关键词并选择输出语言后即可生成。生成的内容可直接复制到图片的 alt 属性。该网站还在生成器旁提供“Alt Scanner”,并支持多语言输出。 对于有积压任务的团队,批量上传功能可以一次性处理多张图片,定位为快速消除可访问性缺口并解决 SEO 审核警告的方式。供应商声称采用多层验证来确保准确性和可读性,输出符合 WCAG 标准,并且描述避免幻觉式细节——但与任何 AI 视觉工具一样,输出质量仍需核实,尤其对于细微或特定领域的图像。 与手动编写 alt 文本或内置 CMS 可访问性检查器相比,Altxt AI 的优势在于批量处理的速度和便捷性。其权衡点与自动描述工具的典型情况相符:生成的文本仍可能需要人工审核以确保准确性和语气;它以独立网页工具形式运行,而非原生 CMS 集成;以及 SEO 效益取决于合适的关键词输入和准确的图像识别。
标准细分
- 基于视觉模型的图像分析,识别对象、场景和上下文
- 可选的SEO关键词输入,用于关键词感知的替代文本
- 批量上传多个图片(PNG/JPG/GIF/WebP)
- 图片网址输入以及直接上传
- 多语言描述输出
- 生成器旁的替代文本扫描器


Face Shape Detector 是一款免费、基于网页的工具,可分析你的面部照片并将其归类为七种已知的脸型之一:椭圆形、圆形、方形、心形、菱形、长方形或三角形。随后,它会将检测结果转化为实用的造型建议——包括发型、眼镜框、妆容修容以及胡须的推荐,均依据你的面部比例量身定制。该工具解决了使用卷尺手动测量脸型的猜测难题,实现了在一分钟内完成的自动化分析。 工具基于 Google 的 MediaPipe 人脸关键点技术,能够在上传的图像上映射 478 个面部关键点。通过这些关键点测量额头宽度、颧骨宽度、下颌线宽度以及整体脸长,并计算区分不同脸型的比例关系。结果会以每种脸型的置信度分布形式展示,而非单一二元答案,从而让用户了解面部与各类脸型的匹配程度。值得注意的是,所有分析均在浏览器本地完成,照片永不上传至服务器或存储,较之需要远程处理的工具提供了显著的隐私优势。 使用方式非常简便:上传 JPG、PNG 或 WebP 格式的图片,或直接使用设备摄像头拍摄,系统约在 30 秒内返回结果。建议使用光线均匀、正面、头发束起的清晰照片以获得最佳准确度。无需注册、邮箱或付款,且可在手机、平板和桌面端直接使用,无需安装应用。 该工具面向日常用户,帮助他们了解自己的脸型以进行造型决策——如选择新发型、挑选眼镜框、学习妆容修容或决定胡须风格。它属于同一开发者提供的浏览器美容与造型工具套装的一部分,还包括眼型检测、面部对称性测试、色彩季节分析、身形计算器和唇形分析等功能。 主要优势在于隐私保护、快速响应、零成本以及基于业界认可的关键点检测库。局限性则属于此类工具的固有问题:脸型分类本身带有主观性,且受照片角度、光线和发际线可见度影响,结果可能因照片而异;造型建议为通用指导,而非专业定制;工具的准确度高度依赖输入图像质量。
标准细分
- AI 脸型检测,涵盖七种分类
- 通过 MediaPipe 实现 478 点面部关键点映射
- 本地浏览器内处理,无需上传至服务器
- 为每种脸型提供置信度细分
- 提供发型、眼镜、妆容及胡须的推荐
- 支持照片上传或实时摄像头捕获


Image Text Editor 是一款基于网页的工具,能够在现有图片中编辑文字,而无需使用传统的照片编辑软件。用户不必处理图层、遮罩或手动选择字体,只需上传图片并用自然语言描述想要的更改——例如把“50% OFF”改为“60% OFF”,或替换地点名称。该工具利用 AI 检测原始文字并在原位置重新生成,力求与周围背景、光照、字体风格、大小和颜色匹配。 此产品面向需要快速编辑文本但缺乏设计技能或无法使用 Photoshop 等工具的人群——营销人员更新宣传文案、电子商务卖家更改产品照片上的价格或标签,以及社交媒体创作者调整标题或表情包。网站始终强调截图编辑,将工具定位为用于更新应用截图、网站截屏和社交帖子,在需要更改文字但保持视觉上下文不变的场景中。 工作流程很简单:上传 JPG、PNG 或 WEBP 文件(最多 5MB),输入描述所需文本更改的提示,预览结果,然后下载编辑后的图像。该网站指出,具体说明新文本以及是否保留原始字体、大小和颜色会提升效果。该服务采用积分系统,注册时会为新用户赠送免费积分。 主要吸引力在于速度与便利——用一条文字指令取代手动图层编辑和寻找字体。自动匹配字体是其主打功能,旨在让编辑后的文字自然融入。与这类大多数 AI 图像编辑工具相同,效果会因图像复杂度、字体稀有度以及背景纹理而异,同时 5 MB 的上传限制和按积分计费的定价模式也是需要注意的实用约束。它与通用 AI 图像编辑器和修补工具竞争,但通过专注于文本编辑这一细分场景来实现差异化。
标准细分
- 基于提示的图像文本编辑
- 自动匹配同款字体
- 截图文本编辑
- 背景和光线保留
- 支持 JPG、PNG 和 WEBP 格式
- 即时预览和下载




