OpenAI bracht GPT-6.1 Sol op 29 september uit, tegelijk met de lancering van Dots. Het model benadert volgens het bedrijf de resultaten van Astra, maar tegen een fractie van de kosten, meldde The Decoder. De standaardtarieven zijn onveranderd ten opzichte van GPT-6 Sol: een miljoen invoertokens kost $2 en een miljoen uitvoertokens $10. Voor gewoon chatgebruik verandert er dus niets aan de rekening.
De verandering zit in gecachte invoer, waarvan de prijs volgens FourWeekMBA en The Decoder is gedaald tot $0.10 per miljoen tokens, de helft van de eerdere $0.20. Caching wordt toegepast wanneer een model opnieuw dezelfde informatie krijgt. Dat is precies hoe agenten werken: bij elke stap van een taak lezen ze de instructies, geschiedenis en eerdere documenten opnieuw. Herhaalde context vormt daardoor een groot deel van hun verbruik.
De verlaging is vooral van belang voor mensen die per token betalen, met name voor wie een zelfgehoste agent zoals OpenClaw gebruikt met een eigen API-sleutel. OpenClaw laat gebruikers zelf het achterliggende model kiezen. Bij lange automatiseringen bestaat het verbruik daar grotendeels uit opnieuw aangeleverde context. Een ontspoorde lus kost nog altijd geld, maar het deel dat naar gecachte invoer gaat, is nu gehalveerd.
Wie per token betaalt, doet er goed aan te controleren of promptcaching is ingeschakeld: de korting geldt alleen voor gecachte invoer. Houd het verbruik in de gaten tijdens de eerste weken van een lange automatisering.