Deep Dive
Einen Tag nach der Erklärung, wie GPT-5.6 sich selbst günstiger zu betreiben half, gibt OpenAI die Gains weiter: GPT-5.6 Luna (schnellste/günstigste Stufe) kostet 80 % weniger; GPT-5.6 Terra (Alltagsstufe) 20 % weniger. Die niedrigeren Raten zählen auch anders gegen Paid-Abos in Codex und ChatGPT Work. Sol-Preise bleiben unverändert.

“Our efficiency edge comes from improving the models, the inference systems that run them, and the agentic harness that connects them to tools and context.”
Woher die Einsparungen kommen
OpenAI schreibt den Effizienzvorsprung drei Schichten zu: den Modellen, den Inference-Systemen und dem agentischen Harness zu Tools und Kontext. Im selben Post half GPT-5.6 Sol laut OpenAI bei Production-Kernels und Speculative-Decoding-Experimenten — etwa 20 % niedrigere End-to-End-Serving-Kosten und mehr als 15 % bessere Token-Generierungseffizienz.
OpenAI lesen
- Advancing the price-performance frontier with GPT-5.6 — Price cuts and efficiency framing
- Previewing GPT-5.6 Sol — Sol / Terra / Luna tiers
