1. Voorpagina
  2. Nieuws
  3. GPT-6.1 Sol halveert de prijs van gecachte invoer en verlaagt zo de kosten van lange agenttaken
Prijzen

GPT-6.1 Sol halveert de prijs van gecachte invoer en verlaagt zo de kosten van lange agenttaken

De hoofdprijzen blijven $2 voor invoer en $10 voor uitvoer per miljoen tokens, maar de herhaalde context waarop agenten leunen, kost nu de helft.

OpenAI bracht GPT-6.1 Sol op 29 september uit, tegelijk met de lancering van Dots. Het model benadert volgens het bedrijf de resultaten van Astra, maar tegen een fractie van de kosten, meldde The Decoder. De standaardtarieven zijn onveranderd ten opzichte van GPT-6 Sol: een miljoen invoertokens kost $2 en een miljoen uitvoertokens $10. Voor gewoon chatgebruik verandert er dus niets aan de rekening.

De verandering zit in gecachte invoer, waarvan de prijs volgens FourWeekMBA en The Decoder is gedaald tot $0.10 per miljoen tokens, de helft van de eerdere $0.20. Caching wordt toegepast wanneer een model opnieuw dezelfde informatie krijgt. Dat is precies hoe agenten werken: bij elke stap van een taak lezen ze de instructies, geschiedenis en eerdere documenten opnieuw. Herhaalde context vormt daardoor een groot deel van hun verbruik.

De verlaging is vooral van belang voor mensen die per token betalen, met name voor wie een zelfgehoste agent zoals OpenClaw gebruikt met een eigen API-sleutel. OpenClaw laat gebruikers zelf het achterliggende model kiezen. Bij lange automatiseringen bestaat het verbruik daar grotendeels uit opnieuw aangeleverde context. Een ontspoorde lus kost nog altijd geld, maar het deel dat naar gecachte invoer gaat, is nu gehalveerd.

Wat dit voor jou betekent

Wie per token betaalt, doet er goed aan te controleren of promptcaching is ingeschakeld: de korting geldt alleen voor gecachte invoer. Houd het verbruik in de gaten tijdens de eerste weken van een lange automatisering.