Callosum recauda 100 millones de dólares para enrutar tareas de IA a través de modelos y chips
Bloomberg informa que Atomico lideró la financiación inicial de la startup londinense de Danyal Akarca y Jascha Achterberg, con la participación de Plural, DCVC y el Sovereign AI Fund del Reino Unido.
By RuntimeWire Staff · Published
Primary source: Bloomberg Technology
Why it matters
Callosum is betting the valuable layer in AI will be software that selects the cheapest workable model-chip pairing, giving it upside across hardware winners.

Callosum, la startup londinense de infraestructura de IA fundada por Danyal Akarca y Jascha Achterberg, ha recaudado $100 millones en financiamiento semilla liderado por Atomico, Plural y DCVC, según Bloomberg el 20 de agosto. El Sovereign AI Fund del Reino Unido también participó, según Bloomberg. El fondo respaldado por el gobierno hizo lo que Callosum describió como una inversión significativa. Callosum no divulgó una valoración.
El financiamiento reportado por Bloomberg sigue a un pre-semilla de $10.25 millones que Callosum había divulgado antes. La tesis de IA heterogénea de los fundadores surgió de su investigación en neurociencias y computación en Cambridge, como Achterberg explicó cuando Callosum salió del sigilo. Argumentan que los sistemas de IA deberían combinar modelos especializados y sustratos de cómputo en lugar de enviar cada tarea a través de un único modelo de propósito general. Callosum aplica esa idea a la infraestructura, asignando partes de un flujo de trabajo a distintos modelos, procesadores e instancias en la nube según el costo, la velocidad y la capacidad.
Los fundadores están llevando ese argumento a un mercado construido en gran medida alrededor de clústeres homogéneos de GPUs de Nvidia. Callosum quiere convertirse en la capa de enrutamiento y orquestación por encima de ese hardware, dando a las empresas una forma de combinar aceleradores consolidados con chips más nuevos sin reconstruir las aplicaciones alrededor de cada proveedor. Callosum dice que está construyendo para organizaciones que despliegan flujos de trabajo de IA multi-modelo y para empresas de hardware que buscan cargas de trabajo de producción.
Dos neurocientíficos abordan la pila de IA
Akarca se formó como médico en la University of Southampton antes de completar un doctorado en neurociencia computacional en Cambridge. Su trabajo doctoral examinó cómo se desarrollan las redes cerebrales bajo restricciones físicas y metabólicas, seguido de investigaciones en la MRC Cognition and Brain Sciences Unit de Cambridge y en Imperial College London.
Achterberg completó su doctorado en Cambridge bajo la supervisión del neurocientífico John Duncan y del investigador de Google DeepMind Matthew Botvinick, con colaboraciones de investigación que involucraron a DeepMind e Intel Labs. Posteriormente fue becario de investigación en St John's College, Oxford, estudiando cómo los circuitos neuronales especializados se coordinan para producir cognición flexible.
Los antecedentes académicos del par son centrales para la arquitectura de Callosum. Su trabajo trató la cognición como un problema de sistemas que involucra módulos especializados, restricciones de comunicación y tareas computacionales distintas. En una publicación técnica de la compañía, Callosum dijo que un "modelo semilla" establece un plan, submodelos manejan tareas como expansión, recuperación y verificación, y el software despacha cada operación al hardware adecuado según su perfil de cómputo.
Achterberg escribió cuando Callosum salió del sigilo en febrero que la inteligencia depende de "la diversidad de mecanismos cooptimados que trabajan juntos". Los fundadores han trasladado esa visión a una estrategia de producto que trata a los modelos y a los sustratos de computación como componentes que el software debe coordinar para los clientes.
Callosum no ha divulgado públicamente la plantilla verificada, la cantidad de clientes, ingresos ni cifras de despliegues comerciales.
La apuesta reportada de $100 millones en la capa de enrutamiento
Callosum había divulgado previamente un pre-semilla de $10.25 millones liderado por Plural, con la participación de ARIA, el Sovereign AI Fund del Reino Unido y inversionistas ángeles no identificados. El gobierno del Reino Unido describió a Callosum como la primera inversión de capital de la iniciativa Sovereign AI. La relación entre ese capital inicial y la semilla de $100 millones reportada por Bloomberg sigue sin estar clara, por lo que el financiamiento total de Callosum no puede declararse con precisión a partir de las divulgaciones disponibles.
Callosum describe su producto como software para coordinar modelos, chips y flujos de trabajo heterogéneos. Callosum dice que el sistema asigna distintas partes de una carga de trabajo según el costo, la velocidad y la capacidad de los componentes disponibles.
Esa posición podría beneficiar a Callosum frente a varios proveedores de hardware. Los nuevos aceleradores necesitan software y cargas de trabajo compatibles antes de que los compradores los desplieguen. Las empresas, por su parte, quieren facturas de inferencia más bajas y menos dependencia de un único proveedor de hardware. Callosum está intentando servir a ambos grupos haciendo que procesadores menos establecidos sean utilizables dentro de sistemas de IA en producción.
El Sovereign AI Fund del Reino Unido es descrito por el gobierno como un fondo con $677 millones que ofrece inversión de capital, acceso a computación pública, rutas de adquisición y visas de talento de vía rápida para ayudar a las empresas británicas de IA a comenzar, escalar y permanecer ancladas en el Reino Unido. Su respaldo coloca el software de orquestación de Callosum dentro del esfuerzo del gobierno por construir influencia doméstica sobre la infraestructura de IA.
Callosum dijo en febrero que estaba colaborando con Normal Computing, Mixx, Cortical Labs y Great Sky en proyectos de cómputo heterogéneo.
Callosum también ha trabajado con CommonAI en un proyecto de cómputo heterogéneo colocalizado apoyado por una subvención de ARIA de $2.9 millones. Los proyectos son intensivos en investigación, pero definen el alcance técnico de la apuesta de los fundadores: la infraestructura de IA se fragmentará más allá de la mezcla actual de GPUs y aceleradores de nube convencionales.
Los benchmarks ahora necesitan convertirse en un negocio
En una publicación técnica de la compañía, Callosum afirmó que las primeras demostraciones produjeron hasta 12 veces menor costo y 5.5 veces mejor rendimiento en ciertas cargas de trabajo de contexto profundo. También reportó mayor calidad a menor costo que una línea base de un solo modelo en la tarea de resumir actividad de GitHub de un socio. Esas cifras provienen de las propias pruebas de Callosum, y los resultados varían según el modelo, el emparejamiento de hardware y la carga de trabajo.
La prueba comercial de Callosum es si el enrutamiento a nivel de tarea puede conservar esos ahorros bajo requisitos de producción como confiabilidad, observabilidad y precios predecibles. El trabajo de enrutamiento entre varios proveedores crea problemas de redes y de gestión de fallos propios. Los clientes también necesitan una responsabilidad clara cuando un componente en un flujo de trabajo multi-modelo falla. Callosum no ha establecido un modelo de precios público ni ha divulgado clientes, ingresos o la escala de despliegues comerciales.
Los fundadores están entrando a un mercado de inferencia fuertemente financiado. Baseten recaudó $300 millones con una valoración de $5 mil millones en febrero. En un anuncio de julio, Fireworks AI dijo que recaudó $1,505 millones en una Serie D con una valoración de $17.5 mil millones. Tensormesh, que enfatiza el caching y la reutilización de contexto procesado anteriormente, recaudó $20 millones en mayo. Infinity, que adapta cargas de inferencia a nuevas arquitecturas de chips, recaudó $15 millones en julio.
La distinción más concreta de Callosum es su intento por optimizar tareas individuales a través de varios modelos, proveedores de nube y tipos de hardware, incluidos procesadores que aún no han alcanzado una adopción amplia. El financiamiento de $100 millones reportado para Callosum daría a Akarca y Achterberg capital para probar si el enrutamiento a nivel de tarea puede reducir los costos de inferencia a través de múltiples modelos, proveedores de nube y tipos de aceleradores. Su apuesta depende de la continua fragmentación en la pila de IA. Una concentración alrededor de un puñado de proveedores de modelos y hardware dejaría a Callosum con menos diferencias que explotar.