Analyse
Un jour après avoir expliqué comment GPT-5.6 s’est rendu moins cher à servir, OpenAI répercute les gains : GPT-5.6 Luna, le palier le plus rapide et abordable, coûte 80 % moins ; GPT-5.6 Terra, le palier équilibré du quotidien, 20 % moins. Ces tarifs réduisent aussi la consommation de crédits sur les abonnements payants Codex et ChatGPT Work. Les prix Sol ne bougent pas.

“Our efficiency edge comes from improving the models, the inference systems that run them, and the agentic harness that connects them to tools and context.”
D’où viennent les économies
OpenAI attribue l’avantage d’efficacité à trois couches : les modèles, les systèmes d’inférence, et le harness agentique qui les relie aux outils et au contexte. Dans le même billet, GPT-5.6 Sol aurait aidé à réécrire des kernels de production et à lancer des expériences de speculative decoding — environ 20 % de coût de serving de bout en bout en moins et plus de 15 % d’efficacité de génération de tokens, selon OpenAI.
Lire OpenAI
- Advancing the price-performance frontier with GPT-5.6 — Price cuts and efficiency framing
- Previewing GPT-5.6 Sol — Sol / Terra / Luna tiers
