Invideo 的 Agent One 在 Physion Labs 的 AI 视频代理基准测试中排名第一

该公司在收到请求后添加了其工具,在16项指标中取得了12项最高分,并在客观正确性方面得分82.3,在人类偏好方面得分62.5。

By · Published

Primary source: X

Why it matters

Independent validation shows Invideo's AI video agent can combine factual accuracy with viewer appeal, a rare achievement that could accelerate enterprise adoption and reshape competitive dynamics in the AI video generation market.

Invideo's Agent One ranks first in Physion Labs AI video agent benchmark

Invideo 宣布,其 Agent One 在 Physion Labs 发布的最新独立 AI 视频代理基准测试中名列第一。2026年7月26日发布的推文称,该公司最初并未被纳入研究,随后请求加入,现在领先于结果。(Invideo 在 X 上)

基准测试摘要图表

Physion Labs 于 2026 年 7 月中旬发布了该基准测试,评估了多种 AI 视频生成工具的 16 项量化和定性指标。根据 Invideo 的推文串,Agent One 在其中 12 项指标中排名第一,并且在任何指标上都未跌出第二名。公司强调了两类指标:衡量事实正确性的客观得分(82.3)和反映人类偏好的主观得分(62.5)。两者均位居榜首。推文串链接到了更新后的基准表格,尽管完整的博客文章尚未更新。

Invideo 的公开声明将被纳入一事表述为对疏漏的回应。推文写道:“上周 Physion Labs 发布了一项独立的 AI 视频代理基准测试。Invideo 没有在其中。我们请求他们把我们加入。”请求似乎已被采纳,公司以此结果论证“演示是营销。评估是证据。”

Agent One 是 Invideo 的旗舰 AI 视频代理,作为一款可在较长时长内生成连贯叙事的工具进行推广,这也是推文中强调的一个挑战。在第二条推文中,Invideo 指出“叙事连贯性、电影语言和制作质量”是大多数代理容易失误的难点。通过宣称自己在这些维度上表现强劲,Invideo 旨在与只能制作短时高质量片段的竞争者区分开来。

该基准测试的重要性超出了单一排行榜。独立评估——尤其是将客观正确性与人工评分偏好相结合的评估——在 AI 视频生成领域很少见。大多数厂商依赖内部演示或有选择性的案例研究。通过在客观和主观两大类指标上均获得第一名,Invideo 发出信号,表明其系统既能满足技术准确性,又能符合观众吸引力,这种组合通常是投资者和企业客户所要求的。

竞争格局包括 Runway、Synthesia 和 Meta 的 Make‑A‑Video 等知名玩家,它们在剧本控制、视觉风格和输出时长方面各有不同程度的控制能力。推文中未提及这些竞争对手,但过去两年中面向 AI 驱动的视频创作工具的融资激增。分析师警告称,从短片扩展到完整长度叙事仍是一个未解决的问题。Invideo 宣称在所有指标上持续保持前二名的表现,暗示其在其他人停滞的领域可能取得了进展。

Invideo 在推文串结尾感谢了 Physion Labs 的纳入,并指出预计会有更新的博客文章。公司将该基准视为该类别的“基本门槛”,暗示未来客户将把这种独立验证视为基线要求。

尽管推文提供了主要数字,但并未披露完整的方法论、样本量或具体测试的代理。这些细节对于分析师评估结果向现实生产流程的可迁移性至关重要。在 Physion Labs 博客更新之前,社区只能依赖 X 推文串中共享的快照。

该公告强调了一个更广泛的趋势:AI 视频初创公司正越来越多地寻求第三方验证,以超越炒作并证明规模化实用性。如果 Invideo 的 Agent One 能持续交付叙事级的视频内容,可能会促使更大的平台集成其技术或考虑收购,这一模式在以往的 AI 媒体交易中已有先例。

投资者可能会密切关注 Physion Labs 的任何后续数据发布,因为该基准可能成为该领域未来融资轮的参考点。目前,Invideo 将自己定位为在一个客观质量与人类偏好常常背离的类别中的新领导者。

Reader comments

Conversation for this story loads after sign-in.