OpenAI recorta los precios de la API de GPT-5.6 Luna en un 80% y añade un nivel Sol más rápido
Luna cae a $0.20 por entrada y $1.20 por salida por cada millón de tokens; el modo Sol Fast promete hasta 2.5 veces la velocidad a cambio del doble de la tarifa estándar.
By Ryan Merket · Published
Primary source: OpenAI on X
Why it matters
Luna's 80% price cut can materially lower the cost of coding agents, review systems and high-volume automation. OpenAI is using inference pricing and latency tiers to drive API adoption without cutting Sol's standard rate.

OpenAI (@OpenAI) recortó los precios de la API para GPT-5.6 Luna en un 80% y para GPT-5.6 Terra en un 20% el 30 de julio, a la vez que introdujo una opción de procesamiento más rápida para su modelo insignia GPT-5.6 Sol. Las reducciones dejan a Luna en $0.20 por millón de tokens de entrada y $1.20 por millón de tokens de salida, mientras que Terra ahora cuesta $2 por entrada y $12 por salida. (developers.openai.com)
Para el cofundador y CEO Sam Altman, el movimiento de precios avanza una tesis de distribución que él reafirmó en abril: OpenAI quiere poner IA de propósito general cada vez más capaz en manos de la mayor cantidad posible de personas. El efecto comercial inmediato es más reducido y más fácil de medir. Los desarrolladores pueden ejecutar cargas de trabajo de alto volumen en Luna por una quinta parte de lo que OpenAI cobraba cuando la familia GPT-5.6 se hizo generalmente disponible el 9 de julio. (openai.com)
OpenAI lanzó GPT-5.6 con tres niveles: Sol para su trabajo de mayor capacidad, Terra para cargas de trabajo que equilibran rendimiento y costo, y Luna para aplicaciones sensibles al costo y de alto volumen. Al lanzamiento, OpenAI fijó el precio de Luna en $1 por millón de tokens de entrada y $6 por millón de tokens de salida. Terra comenzó en $2.50 y $15, respectivamente. El precio estándar de Sol se mantiene en $5 por entrada y $30 por salida. (openai.com)
Qué cambió
La documentación actualizada de Luna lista una tarifa de entrada en caché de $0.02 junto con los nuevos precios de $0.20 por entrada y $1.20 por salida. La documentación de Terra lista la entrada en caché en $0.20, la entrada estándar en $2 y la salida en $12. Ambos modelos conservan una ventana de contexto de 1.05 millones de tokens y un máximo de salida de 128,000 tokens. Las solicitudes que contienen más de 272,000 tokens de entrada siguen sujetas a tarifas más altas por contexto largo. (developers.openai.com)
OpenAI también introdujo Fast mode para GPT-5.6 Sol, prometiendo hasta 2.5x la velocidad del procesamiento Standard con la misma inteligencia del modelo. Fast mode cuesta el doble de la tarifa estándar por token, situando las solicitudes de Sol con contexto corto en $10 por millón de tokens de entrada, $1 por millón de tokens de entrada en caché y $60 por millón de tokens de salida. Los desarrolladores pueden activarlo con service_tier: "fast" o la configuración anterior service_tier: "priority". OpenAI renombró Priority processing a Fast mode el 30 de julio. (developers.openai.com)
Esa estructura de precios crea una disyuntiva directa para aplicaciones donde el tiempo de respuesta afecta la conversión, las tasas de finalización o la revisión humana. Los desarrolladores pueden mantener el procesamiento Standard de Sol para trabajo en segundo plano, y luego pagar una prima por las solicitudes orientadas al usuario donde la latencia tiene un costo mayor que los tokens. La documentación de OpenAI desaconseja enviar trabajos grandes por lotes o de procesamiento de datos mediante Fast mode. (developers.openai.com)
OpenAI impulsa a Luna más profundamente en los flujos de trabajo de agentes
La compañía también está moviendo Auto-review en la app ChatGPT y en Codex CLI de GPT-5.4 a GPT-5.6 Luna. OpenAI dice que el cambio de modelo y la reducción de precio deberían recortar el costo de Auto-review en aproximadamente 10x. Esa estimación proviene de la empresa, y los ahorros reales dependerán de cuántos tokens consuma una revisión y de si una carga de trabajo activa las tarifas por contexto largo.
El cambio de Auto-review muestra dónde OpenAI espera el mayor efecto de precios. Los productos de agentes pueden generar llamadas repetidas al modelo para planificación, uso de herramientas, verificación y revisión, por lo que el costo de un flujo de trabajo puede crecer mucho más rápido de lo que sugiere el precio de un solo prompt. Una reducción del 80% da a los desarrolladores más espacio para ejecutar verificaciones secundarias, mantener sesiones más largas o atender tareas de menor valor sin alejarlas de la familia GPT-5.6.
OpenAI lanzó una vista previa limitada de GPT-5.6 el 26 de junio y puso la familia a disposición general el 9 de julio. Recortar el precio de Luna solo tres semanas después indica que la economía de la inferencia se ha convertido en parte del propio ciclo de lanzamiento del producto. OpenAI está usando modelos de menor costo para ampliar la distribución de la API mientras preserva precios premium para Sol y cobra por separado cuando los clientes necesitan mayor velocidad. (openai.com)