Alle artikelen
Trends2026-07-31

OpenAI-model hielp zijn eigen kosten met 20% verlagen

OpenAI verlaagt de API-prijs van GPT-5.6 Luna met 80% en die van Terra met 20%. Voor Sol komt Fast mode beschikbaar. De nieuwe tarieven, de kanttekeningen bij de claims en wat het betekent voor je automatisering.

OpenAI-model hielp zijn eigen kosten met 20% verlagen

OpenAI verlaagde op 30 juli de API-prijzen van GPT-5.6. Slechts drie weken na de lancering. Luna werd 80 procent goedkoper en Terra 20 procent. Sol blijft even duur, maar krijgt een snellere stand tegen een hoger tarief.

De nieuwe tarieven

De prijzen hieronder gelden per miljoen tokens. Eerst input, daarna output.

  • Luna: van $1 / $6 naar $0,20 / $1,20
  • Terra: van $2,50 / $15 naar $2 / $12
  • Sol: onveranderd op $5 / $30

Verwerk je meer dan 272.000 inputtokens in één aanvraag? Dan verdubbelt de inputprijs en wordt de output 50 procent duurder. Dat speelt vooral bij zeer grote documenten.

Luna wordt hiermee interessant voor grote volumes. Volgens OpenAI presteert het model op Agents' Last Exam, een test voor professioneel werk, beter dan Claude Fable 5. De geschatte kosten per taak liggen bijna 99 procent lager. Luna zou ook bijna negen keer sneller zijn dan modellen die een jaar geleden tot de top behoorden, voor ongeveer 6 procent van de kosten per taak.

Dit zijn cijfers van OpenAI zelf. De gekozen test maakt verschil. Bij de lancering ging het om de Coding Agent Index. Daarop scoorde Luna lager dan Fable 5. Nu gaat het om Agents' Last Exam, een test voor ander werk. Je kunt die uitslagen niet rechtstreeks vergelijken.

Fast mode vervangt Priority Processing

Fast mode vervangt Priority Processing in de API. Sol werkt daarmee tot 2,5 keer sneller voor het dubbele tarief. De intelligentie blijft gelijk. Bestaande aanvragen met service_tier: "priority" blijven werken en gebruiken automatisch Fast mode. In Codex sluit dit aan op /fast.

Anthropic gebruikt bij Claude Opus 5 dezelfde prijslogica. Ook daar krijg je ongeveer 2,5 keer meer snelheid voor het dubbele tarief. Snelheid is een apart product geworden. Je koopt het per aanvraag, los van kwaliteit.

In ChatGPT Work en Codex blijven de abonnementsprijzen en quota gelijk. Terra en Luna verbruiken wel minder credits. Je kunt dus meer werk doen met hetzelfde budget. Free en Go hebben toegang tot Terra. Plus, Pro, Business en Enterprise kunnen Terra en Luna kiezen.

OpenAI-model Sol hielp zelf de kosten verlagen

Onder menselijke leiding verbeterde Sol de software waarop het model draait. Het model voerde honderden experimenten uit en hield trainingen in de gaten. Volgens OpenAI daalden de totale kosten om het model te draaien hierdoor met 20 procent. Het genereren van tokens werd ruim 15 procent efficiënter.

Dit zien we dagelijks terug bij AI-agents. De winst zit niet in één antwoord. De winst zit in meten, aanpassen en opnieuw proberen.

Wat nu rendabel kan worden

Een prijsverlaging van 80 procent maakt vooral werk met veel herhaling goedkoper. Denk aan:

  • grote hoeveelheden documenten doorzoeken
  • klantvragen indelen
  • eenvoudige softwarewijzigingen uitvoeren en testen

Je hoeft niet het hele proces op één model te draaien. Laat een zwaar model het probleem uitzoeken en een plan maken. Laat Luna daarna de duidelijke stappen uitvoeren en controleren. Zo betaal je alleen voor extra denkkracht wanneer die nodig is.

Kijk wel naar de kosten van een complete taak. Een goedkoop model dat drie pogingen nodig heeft, kan duurder zijn dan een duur model dat het direct goed doet.

Zet de modelkeuze op één plek in je applicatie. Dan kun je een prijsverlaging direct benutten. Zit de keuze verspreid door je code, dan betaal je volgende maand nog het oude tarief.

Benieuwd welk werk in jouw bedrijf nu wél rendabel is om te automatiseren? Doe de gratis automatiseringsscan of plan een strategiegesprek.