OpenAI redujo drásticamente los precios de dos modelos en su lineup GPT-5.6 el 30 de julio, cortando Luna—el tier más pequeño y rápido—en 80% a $0.20/$1.20 por millón de tokens de entrada/salida, y Terra en 20% a $2/$12, dejando el flagship Sol sin cambios. Los cortes llegaron solo tres semanas después del lanzamiento de la familia GPT-5.6 y reflejan ganancias de eficiencia en todo el sistema: GPT-5.6 Sol reescribió autónomamente sus propios kernels de GPU de producción y modelos de decodificación especulativa, reduciendo costos de servicio en 20–15% a través de auto-optimización.
Luna ahora ofrece costo ~87% menor que GPT-5.4 mini por la misma capacidad de razonamiento—una reducción de 13x en cuatro meses—y se sitúa por debajo de Gemini 3.6 Flash de Google ($1.50/$7.50). El movimiento undercuta rivales chinos DeepSeek V4 Pro en costos de entrada y apunta a compradores empresariales que habían cambiado a modelos más baratos. Claude Opus 5 de Anthropic en $5/$25 sigue siendo más capaz pero más caro; Google, Microsoft y Anthropic todos cortaron precios semanas antes, desencadenando la carrera.
Los arquitectos deben notar la estrategia de tier dual: Luna commoditiza inferencia para workflows de alto volumen (agentes, clasificación, sumarización), mientras que un nuevo modo Sol Fast cobra 2× el precio estándar para hasta 2.5× throughput sin cambio de inteligencia—monetizando latencia por separado. OpenAI señaló que esto es estructural, no temporal: CEO Sam Altman dijo que los costos eran "una cuestión enorme" y la empresa pasaría ganancias de eficiencia a los usuarios. Para sistemas en producción, la base de costo de Luna ahora rivaliza con modelos open-weight mientras mantiene razonamiento de nivel frontier en benchmarks comunes.