Agent One de Invideo ocupa el primer lugar en el benchmark de agentes de video de IA de Physion Labs

La compañía agregó su herramienta tras una solicitud, encabezando 12 de 16 métricas y obteniendo una puntuación de 82.3 en corrección objetiva y 62.5 en preferencia humana.

By · Published

Primary source: X

Why it matters

Independent validation shows Invideo's AI video agent can combine factual accuracy with viewer appeal, a rare achievement that could accelerate enterprise adoption and reshape competitive dynamics in the AI video generation market.

Invideo's Agent One ranks first in Physion Labs AI video agent benchmark

Invideo anunció que su Agent One obtuvo el primer lugar en el más reciente benchmark independiente de agentes de video con IA publicado por Physion Labs. El tuit publicado el 26 de julio de 2026 indica que la empresa no fue incluida originalmente en el estudio, solicitó su inclusión y ahora encabeza los resultados. (Invideo en X)

gráfico resumen del benchmark

Physion Labs publicó el benchmark a mediados de julio de 2026, evaluando dieciséis métricas cuantitativas y cualitativas a lo largo de una gama de herramientas de generación de video con IA. Según el hilo de Invideo, Agent One se ubicó en el puesto #1 en doce de esas métricas y nunca bajó del #2 en ninguna. La compañía destaca dos familias de métricas: una puntuación objetiva que mide la corrección factual (82.3) y una puntuación subjetiva que captura la preferencia humana (62.5). Ambas encabezaron la tabla. El hilo enlaza a la tabla de benchmark actualizada, aunque la entrada completa del blog aún no ha sido actualizada.

La declaración pública de Invideo enmarca la inclusión como respuesta a una omisión. El tuit señala: “La semana pasada Physion Labs publicó un benchmark independiente de agentes de video con IA. Invideo no estaba en él. Solicitamos que nos incluyeran.” La solicitud parece haber sido atendida, y la compañía usa el resultado para argumentar que “las demostraciones son marketing. Las evaluaciones son evidencia.”

Agent One es el agente de video con IA insignia de Invideo, comercializado como una herramienta que puede generar narrativas coherentes a lo largo de largos periodos, un desafío destacado en el hilo. En el segundo tuit, Invideo apunta a la “coherencia narrativa, el lenguaje cinematográfico y la calidad de producción” como los problemas difíciles en los que la mayoría de los agentes fallan. Al posicionarse como fuerte en estas dimensiones, Invideo busca diferenciarse de competidores que solo pueden producir clips cortos de alta calidad.

La importancia del benchmark va más allá de una sola tabla de posiciones. Las evaluaciones independientes—especialmente las que combinan corrección objetiva con preferencia calificada por humanos—son escasas en el espacio de generación de video con IA. La mayoría de los proveedores se basan en demos internas o estudios de caso selectivos. Al asegurar el puesto #1 en ambas familias, objetiva y subjetiva, Invideo señala que su sistema puede satisfacer tanto la exactitud técnica como el atractivo para la audiencia, una combinación que inversionistas y clientes empresariales a menudo exigen.

El panorama competitivo incluye actores bien conocidos como Runway, Synthesia y Meta’s Make‑A‑Video, cada uno ofreciendo distintos grados de control sobre el guion, el estilo visual y la duración de la salida. Ninguno de estos rivales se menciona en el hilo, pero el mercado en general ha visto un aumento en la financiación para herramientas de creación de video impulsadas por IA en los últimos dos años. Los analistas han advertido que escalar desde clips cortos hasta narrativas de larga duración sigue siendo un problema no resuelto. La afirmación de Invideo de un rendimiento sostenido dentro de los dos primeros lugares en todas las métricas sugiere que podría haber avanzado donde otros se han estancado.

Invideo concluye el hilo agradeciendo a Physion Labs por la inclusión y señalando que se espera una entrada de blog actualizada. La compañía presenta el benchmark como “requisito mínimo” para la categoría, lo que implica que los clientes futuros esperarán dicha validación independiente como condición básica.

Aunque el tuit ofrece las cifras principales, no revela la metodología completa, el tamaño de la muestra ni los agentes específicos evaluados. Esos detalles serán críticos para que los analistas puedan evaluar cuán transferibles son los resultados a las cadenas de producción del mundo real. Hasta que se actualice el blog de Physion Labs, la comunidad tendrá que depender de la instantánea compartida en el hilo de X.

El anuncio subraya una tendencia más amplia: las startups de video con IA buscan cada vez más validación de terceros para ir más allá del bombo y demostrar utilidad a gran escala. Si Agent One de Invideo puede entregar de forma consistente contenido de video a nivel narrativo, podría forzar a plataformas más grandes a integrar su tecnología o considerar una adquisición, un patrón observado en acuerdos previos en medios impulsados por IA.

Los inversionistas probablemente observarán de cerca cualquier publicación de datos de seguimiento por parte de Physion Labs, ya que el benchmark podría convertirse en un punto de referencia para futuras rondas de financiamiento en el sector. Por ahora, Invideo se posiciona como el nuevo líder en una categoría donde la calidad objetiva y la preferencia humana a menudo han divergido.

Reader comments

Conversation for this story loads after sign-in.