Exa dice que su índice atiende 80 mil millones de páginas, apunta a la escala de Google en 2027

Will Bryk dice que Exa rastrea 1,4 billones de URLs tras una ronda de 250 millones de dólares que financió su impulso hacia la infraestructura de búsqueda independiente.

By · Published

Primary source: Will Bryk on X

Why it matters

If Bryk's figures hold, Exa is becoming a rare independent web-index operator. Its larger test is converting crawl scale into fresher, cheaper and more accurate agent search.

Exa says its index serves 80 billion pages, targets Google scale in 2027 — Will Bryk says Exa tracks 1.4 trillion URLs after a $250 million round financed its push into independent search infrastructure.

El CEO y cofundador de Exa Will Bryk (@WilliamBryk) dijo en una publicación del 3 de agosto en X que Exa ahora atiende 80 mil millones de páginas y rastrea 1.4 billones de URLs. Bryk espera que Exa alcance lo que él llama "Google-scale" a principios de 2027. Las cifras son las propias de Exa, y Bryk reconoció que los proveedores de búsqueda hacen que los tamaños de índice sean difíciles de comparar. (x.com)

Bryk ha estado trabajando hacia ese objetivo desde antes de que los agentes de IA se convirtieran en una categoría de mercado. Estudió informática y física en Harvard, realizó investigación en aprendizaje automático y dirigió el club de robótica de la universidad antes de trabajar como ingeniero en Cresta. Bryk y el cofundador Jeffrey Wang, su compañero de cuarto en Harvard, construyeron un motor de búsqueda temprano en su dormitorio. Wang trabajó luego en datos e infraestructura web en Plaid. La pareja ingresó a la cohorte de verano de 2021 de Y Combinator con un plan para reconstruir la búsqueda web alrededor de la recuperación semántica. (ycombinator.com)

El inventario de URL casi se ha triplicado desde mayo

La nueva cifra de 1.4 billones de URLs rastreadas es casi tres veces los "más de 500 mil millones" de URLs que Exa dijo que sus rastreadores seguían cuando anunció su Serie C el 20 de mayo. La publicación de Bryk distingue ese mayor conjunto de descubrimiento de las 80 mil millones de páginas que Exa dice que puede servir. Esa distinción importa: un rastreador puede descubrir o monitorear URLs sin retener cada página en el corpus activo disponible para los clientes de búsqueda. La página "about" de Exa anuncia por separado infraestructura para más de 500 mil millones de páginas web. Exa no ha publicado una conciliación técnica de sus métricas de rastreadas, indexadas y servidas. (exa.ai)

Bryk estimó el índice de Google en aproximadamente 1 billón de páginas, el de Bing en 500 mil millones y el de Yandex en 200 mil millones. Esas cifras exactas son estimaciones de Bryk más que divulgaciones estandarizadas de los proveedores de búsqueda. Google dice que su índice cubre "cientos de miles de millones" de páginas web y otro contenido digital. Brave's Search API dice que su índice independiente contiene más de 30 mil millones de páginas, mientras que un glosario más reciente de Brave lo sitúa por encima de 40 mil millones. Las diferencias en cómo los proveedores cuentan duplicados, páginas obsoletas, documentos, URLs descubiertas y páginas elegibles para recuperación limitan cualquier clasificación directa por tamaño. (google.com)

Exa está invirtiendo para controlar la pila de búsqueda

La expansión de Exa sigue a una Serie C de 250 millones de dólares liderada por Andreessen Horowitz con una valuación de 2.2 mil millones de dólares en mayo. Exa dijo que la financiación financiaría modelos de recuperación más grandes y la infraestructura suficiente para procesar cientos de miles de búsquedas por segundo. Esa ronda siguió a una Serie B de 85 millones de dólares liderada por Benchmark con una valuación de 700 millones de dólares en septiembre de 2025 y a 22 millones de dólares en financiamiento semilla y de la Serie A anteriores. Exa ha anunciado 357 millones de dólares en financiamiento en esas rondas. (exa.ai)

El impulso de infraestructura respalda una línea de productos dirigida a desarrolladores de software y agentes de IA en lugar de una caja de búsqueda para consumidores. Exa dice que más de 400,000 desarrolladores y 5,000 compañías usan sus productos de búsqueda, nombrando a Cursor, Cognition, HubSpot, OpenRouter y Monday.com entre sus clientes. Esas cifras de adopción son reportadas por la empresa. (exa.ai)

Exa también ha estado convirtiendo el índice subyacente en productos de recuperación más especializados. En abril, Exa se convirtió en proveedor de grounding y socio del marketplace de agentes para los productos empresariales Gemini de Google Cloud. Lanzó Exa Agent en junio para investigación, creación de listas y enriquecimiento de entidades, y luego añadió un índice dedicado de aproximadamente 350 millones de publicaciones académicas el 23 de julio. (exa.ai)

Un corpus más grande le da a Exa más control sobre la cobertura, la frescura y el ranking que las APIs de búsqueda que reempaquetan resultados de un proveedor incumbente. También crea una carga sustancial de infraestructura. Rastrear más URLs por sí solo no garantiza una mejor calidad de búsqueda: Exa aún tiene que mantener frescas las páginas útiles, descartar spam y duplicados, ordenar los resultados de cola larga y entregarlos dentro de los límites de latencia y costo de los flujos de trabajo de agentes. La afirmación de Bryk de 80 mil millones de páginas muestra cuán agresivamente Exa está gastando para cerrar la brecha de escala. Si ese inventario produce mejores respuestas determinará si Exa se convierte en infraestructura central para agentes o en otra API de búsqueda que compite en la periferia de Google y Bing.

Reader comments

Conversation for this story loads after sign-in.