Speko lanza un enrutador basado en pruebas comparativas para modelos de IA de voz
La pasarela respaldada por YC selecciona proveedores de voz según idioma, calidad, latencia y costo, y luego maneja la conmutación por error a través de una sola API.
By Ryan Merket · Published
Primary source: X
Why it matters
Voice AI stacks can age quickly as model quality and pricing change. Speko wants to make continuous evaluation and provider switching an infrastructure function.

Beknazar "Bek" Abdikamalov (@beknabdik) lanzó Speko el 29 de julio, ofreciendo a los desarrolladores de IA de voz una única puerta de entrada que selecciona modelos de voz y lenguaje mediante benchmarks actualizados continuamente.
https://x.com/beknabdik/status/2082544456604287230?s=46
Abdikamalov describió Speko como "OpenRouter for Voice" en el anuncio de lanzamiento. Su premisa es que los modelos de voz a texto y de texto a voz llegan y mejoran demasiado rápido para que los desarrolladores estén continuamente reejecutando comparaciones de proveedores. Speko mide a los proveedores por idioma y enruta las solicitudes según los resultados.
La operación en San Francisco forma parte de la cohorte de verano de 2026 de Y Combinator, donde Speko aparece listada con cuatro personas. Abdikamalov cofundó anteriormente Hupo y se desempeñó como su chief technology officer después de trabajar como ingeniero de software en Amazon. Según YC, posee títulos de licenciatura y maestría en informática por Ulsan National Institute of Science and Technology en Corea del Sur.
Speko es el intento de Abdikamalov por dominar la capa entre las aplicaciones de voz y una colección creciente de proveedores de modelos. Los agentes de voz típicamente combinan reconocimiento de voz, un modelo de lenguaje y síntesis de voz. Cada etapa introduce decisiones separadas en torno a precisión, tiempo de respuesta, cobertura de idiomas, precio y fiabilidad. Cambiar un proveedor puede requerir nuevas credenciales, trabajo de integración y pruebas.
Cómo funciona el enrutador
Speko expone endpoints de speech-to-text, language-model y text-to-speech a través de su TypeScript SDK. Un desarrollador envía una intención de enrutamiento que contiene un idioma y, opcionalmente, una región y un objetivo de optimización. Speko puntúa a los proveedores elegibles, selecciona la opción mejor clasificada y pasa al siguiente candidato si el primer proveedor falla.
Las respuestas incluyen el proveedor, el modelo, el conteo de conmutaciones por fallo y la ejecución de benchmark usada para la decisión. Los desarrolladores también pueden restringir los proveedores elegibles cuando necesitan cumplir reglas de conformidad, limitar costos o fijar un modelo durante la depuración.
Eso hace de Speko una capa de enrutamiento y evaluación en lugar de una pila cerrada de agentes de voz. Speko puede conectarse a frameworks como LiveKit y Pipecat, mientras que su propia plataforma también soporta conversaciones en el navegador y agentes telefónicos entrantes y salientes.
El directorio público de modelos lista 53 entradas: 13 modelos de voz a texto, 16 modelos de lenguaje, 15 modelos de texto a voz y nueve modelos de voz a voz. Speko afirma por separado cobertura de más de 50 proveedores y más de 140 modelos en al menos 10 idiomas, lo que indica que su catálogo comercializado es más amplio que el conjunto mostrado en el directorio.
Los tableros de benchmark de Speko publican mediciones que incluyen la tasa de error de palabras, la latencia de finalización, el tiempo hasta el primer token y el costo estimado. Las clasificaciones varían de manera significativa según la métrica. Un modelo que rinde bien en precisión de transcripción puede quedar por detrás de otro proveedor en latencia de streaming, dejando al enrutador la elección según la carga de trabajo en lugar de declarar un ganador universal.
El modelo de negocio
Speko entra en vista previa pública con tres niveles de precios de autoservicio. Su página de precios ofrece $100 en crédito de registro, un plan de enrutador que cobra 5% por encima de la tarifa del proveedor subyacente y un plan de infraestructura alojado por Speko con un precio de $0.09 por minuto. Ninguno de los planes de la vista previa pública incluye un acuerdo de nivel de servicio. Los contratos empresariales añaden precios personalizados, soporte dedicado y términos de servicio negociados.
Y Combinator es el respaldo públicamente identificado de Speko. YC lista a Speko en su cohorte de verano de 2026; el trato estándar de YC invierte $500,000, dividido entre $125,000 por 7% y $375,000 mediante un SAFE sin tope con cláusula de nación más favorecida.
La propuesta de enrutamiento coloca a Speko junto a proveedores de infraestructura para agentes de voz como Vapi, Retell AI, LiveKit Agents y Pipecat. Esos productos abarcan orquestación, telefonía y frameworks de aplicación. Abdikamalov hace una apuesta de infraestructura más acotada: los desarrolladores querrán elección de modelos y mediciones independientes sin mantener una integración separada para cada proveedor de voz.
Esa apuesta depende de que la capa de benchmark permanezca creíble a medida que el catálogo se expande. El enrutador es útil solo cuando sus pruebas se asemejan al tráfico de producción a través de acentos, idiomas, condiciones de red y cargas conversacionales. La decisión de Speko de publicar resultados fechados y exponer la ejecución del benchmark detrás de cada ruta da a los desarrolladores una forma de inspeccionar esas elecciones. También convierte la metodología de benchmark en el producto central en lugar de un adjunto de marketing.