GitHub agrega Grok 4.6 de xAI a Copilot para agentes de codificación de larga duración
Grok 4.6 de xAI entra en el IDE de GitHub, en la línea de comandos y en los flujos de trabajo empresariales dos días después del lanzamiento, bajo un modelo de facturación por uso.
By RuntimeWire Staff · Published
Primary source: GitHub Changelog
Why it matters
Grok 4.6 reached GitHub Copilot two days after launch, giving xAI a route into established developer and enterprise workflows. The integration makes distribution, cost and agent reliability as important as provider-published benchmark scores.

xAI de Elon Musk (@elonmusk) puso Grok 4.6 en GitHub Copilot el 14 de agosto, extendiendo el modelo de razonamiento de dos días a los editores de GitHub, las herramientas de línea de comandos y el agente de codificación en la nube.
GitHub está implementando Grok 4.6 para suscriptores de Copilot Pro, Pro+, Max, Business y Enterprise. Los desarrolladores podrán seleccionarlo en Visual Studio Code, Visual Studio, Copilot CLI, el agente en la nube de Copilot, la app de Copilot, los IDE de JetBrains, Xcode y Eclipse. GitHub dijo que la disponibilidad se ampliará de forma gradual en lugar de llegar a todas las cuentas elegibles de inmediato.
Para Musk, la integración con Copilot le da a xAI una ruta directa hacia entornos de desarrollo ya establecidos. Musk fundó xAI en 2023 con la misión declarada de construir IA que avance el descubrimiento científico y la comprensión del universo. SpaceX acquired xAI on February 2, 2026, y el sitio oficial de xAI ahora usa la marca SpaceXAI mientras continúa lanzando modelos bajo el nombre Grok.
La página de liderazgo de GitHub lista a Mario Rodriguez como su chief product officer. Microsoft adquirió GitHub por $7.5 billion in 2018, lo que le da a Copilot una base de distribución ligada a los flujos de trabajo de hospedaje de código, revisión y despliegue que los desarrolladores ya usan.
xAI se está distribuyendo a través de los flujos de trabajo de otras personas
xAI released Grok 4.6 el 12 de agosto con énfasis en agentes de larga duración, codificación y trabajo de conocimiento multipartes. En el lanzamiento, Grok 4.6 estuvo disponible a través de Cursor, Grok Build, la API de xAI, OpenRouter, Vercel y Cloudflare. GitHub Copilot siguió dos días después.
La secuencia de lanzamientos muestra cómo Musk está abordando la adopción por parte de desarrolladores. xAI está colocando Grok dentro de herramientas independientes que ya mantienen relaciones con desarrolladores, incluyendo los productos de IDE, línea de comandos, agente en la nube y empresariales de GitHub.
El catálogo de modelos de GitHub también se ha convertido en un mercado de distribución propio. Su documentación de modelos compatibles lista modelos de OpenAI, Anthropic, Google, Microsoft, Moonshot AI y xAI. Los desarrolladores pueden elegir entre ellos, mientras GitHub controla la interfaz, la facturación y los ajustes de política.
Grok 4.6 entra, por tanto, a Copilot como una opción más en un selector abarrotado. xAI obtiene acceso a los clientes de GitHub sin tener que reemplazar su entorno de desarrollo. GitHub obtiene otro proveedor que compite en capacidad y precio dentro de Copilot.
El caso de referencia es mixto
GitHub dijo que sus pruebas internas produjeron resultados sólidos en tareas de codificación basadas en terminal en Visual Studio Code y Copilot CLI, particularmente durante flujos de trabajo más largos que requerían razonamiento sostenido y uso de herramientas. GitHub no publicó el conjunto de tareas, tasas de error, tamaño de muestra ni comparaciones directas detrás de esa evaluación.
xAI's own release ofrece un conjunto más detallado de puntuaciones publicadas por el proveedor. xAI reportó que Grok 4.6 obtuvo 69.9% en CursorBench v3.2, por delante del 67.2% que indicó para GPT-5.6 Sol y por debajo del 70.5% que listó para Claude Fable 5. En DeepSWE v1.1, xAI reportó 65.9% para Grok 4.6, en comparación con 73% para GPT-5.6 Sol y 70% para Fable 5.
El resultado en terminal es especialmente relevante para el anuncio de GitHub. xAI reportó un 26% para Grok 4.6 en Terminal-Bench v3.0, por debajo del 34.6% y 34.1% que publicó para GPT-5.6 Sol y Fable 5. En el Artificial Analysis Intelligence Index, xAI reportó una puntuación de 61 para Grok 4.6, igualando su resultado publicado para GPT-5.6 Sol y quedando un punto detrás de Fable 5. xAI dijo que las puntuaciones de terceros en sus tablas provinieron de system cards publicadas por desarrolladores o de tablas de clasificación públicas de benchmarks.
Esos resultados publicados por proveedores colocan a Grok 4.6 entre modelos de codificación competitivos sin establecerlo de forma independiente como el líder de la categoría. El despliegue de GitHub ofrece a los desarrolladores una manera práctica de probar si las fortalezas reportadas por xAI se transfieren desde entornos de benchmark hacia el trabajo en repositorios, sesiones de depuración y ejecuciones de agentes con uso intensivo de herramientas.
xAI dice que Grok 4.6 recibió una corrida de entrenamiento suplementario más larga que Grok 4.5, usando datos de razonamiento generados por el modelo, datos de ingeniería y tareas de aprendizaje por refuerzo que abarcaron codificación general, optimización de kernels, desarrollo web y diseño asistido por computadora. xAI también afirma que observó más autoevaluación y verificación durante trayectorias más largas. Ambas afirmaciones provienen del propio proceso de evaluación de xAI.
El uso de tokens determinará el costo real
GitHub está implementando Grok 4.6 para suscriptores de Copilot Pro, Pro+, Max, Business y Enterprise. El modelo se factura al precio listado por el proveedor bajo el sistema de uso basado en Copilot.
La tabla de precios actual de GitHub establece las tarifas aplicables por modelo y por solicitud. La tabla lista tarifas idénticas para Grok 4.5 y Grok 4.6, lo que convierte al modelo más nuevo en un candidato de reemplazo directo cuando su rendimiento mejora sin un precio por token listado más alto.
Los agentes de codificación de larga duración aún pueden generar facturas grandes porque leen archivos repetidamente, llaman a herramientas, consumen la salida de pruebas y revisan código. El precio listado del modelo revela menos que la duración y el comportamiento del bucle del agente.
Los administradores de Business y Enterprise deben habilitar explícitamente la política de Grok 4.6, que está desactivada por defecto. Ese control le da a las organizaciones la oportunidad de evaluar el costo, el manejo de datos y el comportamiento del modelo antes de que los desarrolladores envíen contexto de repositorio a través de un nuevo proveedor.
La apuesta de distribución de Musk
xAI dijo en enero de 2026 que recaudó un $20 billion Series E de Valor Equity Partners, StepStone Group, Fidelity Management & Research, Qatar Investment Authority, MGX y Baron Capital, con NVIDIA y Cisco Investments participando como inversionistas estratégicos. xAI dijo que la financiación apoyaría infraestructura de cómputo y despliegue de producto. SpaceX adquirió xAI menos de un mes después.
La llegada de Grok 4.6 a Copilot pone ese capital detrás de una estrategia de producto sencilla: entrenar modelos con suficiente capacidad de razonamiento para ejecuciones de agente más largas, y luego colocarlos donde los desarrolladores ya trabajan. GitHub suministra el acceso a clientes y los controles empresariales. xAI suministra otro modelo para la capa de codificación multi-proveedor de GitHub.
La próxima prueba ocurrirá en datos de uso que GitHub y xAI no han publicado: con qué frecuencia los desarrolladores eligen Grok 4.6, cuánto duran sus ejecuciones de agente, cuánto cuestan esas ejecuciones y si los equipos lo mantienen habilitado después de comparar su uso de código y herramientas con los otros modelos en Copilot.