Análisis
Un día después de explicar cómo GPT-5.6 se hizo más barato de servir, OpenAI traslada las ganancias: GPT-5.6 Luna, el nivel más rápido y asequible, cuesta un 80 % menos; GPT-5.6 Terra, el equilibrado de uso diario, un 20 % menos. Esas tarifas también reducen cómo se cuenta el uso frente a suscripciones de pago en Codex y ChatGPT Work. El precio de Sol no cambia.

“Our efficiency edge comes from improving the models, the inference systems that run them, and the agentic harness that connects them to tools and context.”
De dónde salen los ahorros
OpenAI atribuye la eficiencia a tres capas: los modelos, los sistemas de inferencia y el harness agéntico que los conecta a herramientas y contexto. En el mismo post, GPT-5.6 Sol ayudó a reescribir kernels de producción y a experimentar con speculative decoding: ~20 % menos coste de serving extremo a extremo y más de 15 % de eficiencia de generación de tokens, según OpenAI.
Leer OpenAI
- Advancing the price-performance frontier with GPT-5.6 — Price cuts and efficiency framing
- Previewing GPT-5.6 Sol — Sol / Terra / Luna tiers
