SpaceXAI lanza Grok 4.6 con una ventana de contexto de 500,000 tokens

El modelo mantiene el precio base de la API de Grok 4.5 de $2/$6, agrega una ventana de contexto de 500,000 tokens y se lanza en Cursor y Grok Build.

By · Published

Primary source: VentureBeat

Why it matters

SpaceXAI is pairing Grok 4.6 with its Grok Build agent environment and Cursor distribution while SpaceX's proposed Anysphere acquisition remains pending. Its larger context window, benchmark gains and long-context price increase give developers concrete factors to assess against production reliability and total workload cost.

Illustration of SpaceXAI's Grok 4.6 being deployed across platforms, powering many autonomous agents and integrating into Cursor and Grok Build.

Elon Musk's SpaceXAI (on X) anunció Grok 4.6 el miércoles 12 de agosto, extendiendo su rápido calendario de lanzamientos de modelos con un sistema diseñado para mantenerse enfocado en tareas más largas de codificación y trabajo de conocimiento.

El anuncio del 12 de agosto posiciona a Grok 4.6 como un modelo agente práctico: uno que puede investigar temas desconocidos, navegar una base de código, operar herramientas y convertir una idea amplia de producto en software funcional a lo largo de una secuencia de pasos. Su precio base de API permanece en $2 por cada millón de tokens de entrada y $6 por cada millón de tokens de salida, las mismas tarifas que SpaceXAI fijó para Grok 4.5.

Esos avances en benchmarks, el precio base sin cambios y la distribución a través de Cursor dan a los desarrolladores varias razones para evaluar Grok 4.6 en tareas más largas de codificación y trabajo de conocimiento. El aumento de rendimiento da a las organizaciones de ingeniería motivo para volver a ejecutar evaluaciones de modelos, mientras que el precio de entrada sin cambios permite pruebas en cargas de trabajo mayores.

VentureBeat informó que Grok 4.6 obtuvo 61 en el Artificial Analysis Intelligence Index, cinco puntos por encima de Grok 4.5. La puntuación colocó a Grok por delante de Kimi K3 de Moonshot AI y a la par con GPT-5.6 Sol Max de OpenAI, según el informe. La tabla de evaluación publicada por SpaceXAI muestra a Grok 4.6 con 61 en el Artificial Analysis Intelligence Index y detalla sus resultados en benchmarks.

El anuncio de SpaceXAI confirma que Grok 4.6 estuvo disponible en Cursor y Grok Build en el lanzamiento. La versión enumera por separado la API, OpenRouter, Vercel y Cloudflare como canales de distribución, sin establecer la disponibilidad en el primer día a través de cada socio listado.

Un fundador que consolida la pila tecnológica

SpaceX anunció la adquisición de xAI el 2 de febrero de 2026. xAI anunció una Serie E de $20 mil millones en enero de 2026, con participación de Valor Equity Partners, StepStone Group, Fidelity, Qatar Investment Authority, MGX, Baron Capital, NVIDIA y Cisco Investments.

El historial operativo de Musk abarca software, pagos, vehículos eléctricos y cohetes. La biografía corporativa de Tesla lo lista como un egresado en física y negocios de University of Pennsylvania que cofundó Zip2 y PayPal antes de liderar SpaceX y Tesla y fundar Neuralink y The Boring Company.

La fusión de febrero colocó a SpaceXAI dentro de la estructura corporativa más amplia de SpaceX. SpaceXAI ofrece Grok 4.6 a través de su API, mientras que Grok Build proporciona el entorno agente. Cursor ofrece acceso a desarrolladores de software, aunque la propuesta de adquisición por parte de SpaceX de la empresa matriz de Cursor sigue pendiente.

AP informó que SpaceX acordó adquirir la empresa matriz de Cursor, Anysphere, por aproximadamente $60 mil millones en acciones. Se espera que la transacción se cierre en el tercer trimestre de 2026, sujeta a condiciones de cierre y aprobaciones regulatorias, por lo que la disponibilidad de Grok 4.6 en Cursor precede a cualquier adquisición completada.

Cursor soporta modelos de múltiples laboratorios de vanguardia, incluidas compañías que compiten directamente con SpaceXAI. Por lo tanto, Grok compite por uso dentro de un entorno de codificación que también da a los desarrolladores acceso a modelos rivales.

El precio se mantiene bajo hasta que el contexto se vuelve extenso

Las tarifas de API destacadas por SpaceXAI requieren una salvedad. Los $2 de entrada y $6 de salida se aplican mientras los prompts se mantengan por debajo de 200,000 tokens. Al alcanzar o superar ese umbral, las tarifas se duplican a $4 por cada millón de tokens de entrada y $12 por cada millón de tokens de salida. Una vez que un prompt supera el umbral, las tarifas más altas se aplican a todos los tokens de la solicitud.

La documentación del modelo lista una ventana de contexto de 500,000 tokens, entradas de texto e imagen, salidas estructuradas, razonamiento y llamadas a funciones.

Para un agente que lee repetidamente un repositorio, resultados de herramientas y su propio trabajo previo, el límite de 200,000 tokens puede cambiar materialmente la factura. SpaceXAI sigue fijando el precio de Grok 4.6 por debajo de varios modelos premium de vanguardia en la comparación de VentureBeat, pero los compradores necesitarán probar trayectorias completas en lugar de comparar la primera línea de una tabla de precios.

SpaceXAI también está ofreciendo una variante más rápida de Grok 4.6 al doble del precio estándar. Eso crea una segunda opción comercial para cargas de trabajo donde una menor latencia justifica una factura de tokens más alta.

Las mejoras en benchmarks dejan una brecha en el trabajo en terminal

SpaceXAI dice que Grok 4.6 recibió una ejecución de entrenamiento suplementario más larga que Grok 4.5. SpaceXAI usó razonamiento generado por el modelo y datos técnicos seleccionados, datos de ingeniería, un optimizador actualizado y una receta de entrenamiento revisada. Grok 4.5 luego generó nuevas trayectorias de fine-tuning supervisado en razonamiento, ingeniería de software, STEM y trabajo de conocimiento, con comprobaciones basadas en el modelo que filtraron trazas problemáticas.

El aprendizaje por refuerzo se centró en codificación, desarrollo web, diseño asistido por computadora, optimización de kernel y trabajo de conocimiento general. SpaceXAI dice que el modelo resultante realiza más autoevaluación y autoverificación durante trabajos largos. Esas afirmaciones de comportamiento provienen de pruebas internas y requieren validación en despliegues en vivo.

La tabla de evaluación publicada de SpaceXAI muestra una mejora generacional sustancial sin una barrida completa. Grok 4.6 obtuvo 65.9% en DeepSWE v1.1, frente a 54% de Grok 4.5, mientras que GPT-5.6 Sol Max obtuvo 73%. Alcanzó 69.9% en CursorBench v3.2, comparado con 70.5% de Fable 5 Max. En APEX-Agents, Grok 4.6 subió 10.4 puntos porcentuales hasta 57.5%, superando el resultado listado de GPT-5.6 Sol Max de 56.7% y quedando por detrás de Fable 5 Max con 59.2%.

Terminal-Bench v3.0 sigue siendo una debilidad visible. Grok 4.6 mejoró a 26% desde 15.7%, mientras que las puntuaciones comparativas para GPT-5.6 Sol Max y Fable 5 Max fueron 34.6% y 34.1%, respectivamente. El modelo se ha vuelto más capaz en trabajo en terminal sin cerrar la brecha.

Artificial Analysis describe sus índices de capacidad como compuestos de benchmarks ejecutados de forma independiente y advierte que cualquier índice puede no mapearse directamente a un caso de uso de producción particular. Una puntuación de 61 es evidencia útil para una prueba. No establece la fiabilidad a través del repositorio, las herramientas, los permisos y el proceso de revisión de una organización.

Grok 4.6 sigue a Grok 4.5 por cuatro semanas

Grok 4.6 sigue a Grok 4.5, lanzado el 16 de julio, y mantiene el precio base por token de su predecesor. RuntimeWire describió previamente a Grok 4.5 como el arma de precio de Musk contra los modelos de codificación premium. El nuevo lanzamiento eleva las puntuaciones de los benchmarks mientras mantiene el precio base.

El anuncio de lanzamiento confirma la disponibilidad de Grok 4.6 en Cursor y Grok Build, con el doble de uso incluido en ambos productos durante la primera semana. Su sección de inicio también identifica la API, OpenRouter, Vercel y Cloudflare como canales de distribución. El acceso a Grok Build comienza con el plan SuperGrok de $30 por mes.

El rendimiento del agente está moldeado por el software que rodea al modelo: cómo se arma el contexto, cuándo se llaman las herramientas, cómo se detectan fallos y qué debe aprobar un humano. Grok Build le da a SpaceXAI una capa de producto donde puede afinar esa experiencia de agente alrededor de Grok 4.6.

SpaceXAI ahora entrena el modelo, ofrece el entorno agente Grok Build, vende inferencia y distribuye Grok dentro de Cursor mientras SpaceX persigue su adquisición de la empresa matriz de Cursor, Anysphere. Los resultados de los benchmarks de Grok 4.6 respaldan una evaluación adicional, pero el uso sostenido dependerá de la fiabilidad en producción, el costo total de la carga de trabajo y el rendimiento dentro de cada agente de codificación.

Reader comments

Conversation for this story loads after sign-in.