OpenAI a lancé GPT-6.1 Sol le 29 septembre, en même temps que Dots. Le modèle serait presque au niveau d’Astra pour une fraction de son coût, rapporte The Decoder. Les tarifs standards sont inchangés par rapport à GPT-6 Sol : un million de tokens en entrée coûte $2, et un million en sortie, $10. Pour les conversations ordinaires, la facture ne change donc pas.
Le changement concerne les entrées mises en cache, dont le prix est passé à $0.10 par million de tokens, soit moitié moins que les $0.20 précédents, selon FourWeekMBA et The Decoder. La mise en cache s’applique lorsqu’un modèle reçoit à nouveau les mêmes éléments. C’est précisément ainsi que fonctionnent les agents : à chaque étape d’une tâche, ils relisent les consignes, l’historique et les documents précédents. Le contexte réutilisé représente donc une grande part de leur consommation.
La baisse profite surtout aux personnes qui paient à l’usage, notamment celles qui font tourner un agent auto-hébergé comme OpenClaw avec leur propre clé API. OpenClaw permet de choisir le modèle utilisé, et les automatisations longues reposent largement sur la répétition du contexte. Une boucle incontrôlée coûte toujours de l’argent, mais la part consacrée aux lectures mises en cache est désormais réduite de moitié.
Si vous payez à l’usage, vérifiez que la mise en cache des invites est activée : la réduction ne concerne que les lectures mises en cache. Surveillez votre consommation pendant les premières semaines de toute automatisation longue.