OpenAI ha rilasciato GPT-6.1 Sol il 29 settembre, insieme al lancio di Dots, sostenendo che i risultati sono quasi all’altezza di Astra a una frazione del costo, come riporta The Decoder. Le tariffe standard restano quelle di GPT-6 Sol: un milione di token in entrata costa $2, un milione in uscita $10. Per il normale uso in chat, dunque, la spesa non cambia.
La novità riguarda gli input in cache, il cui costo è sceso a $0.10 per milione di token, la metà dei precedenti $0.20, secondo FourWeekMBA e The Decoder. La cache si applica quando a un modello viene fornito di nuovo lo stesso materiale, ed è proprio così che funzionano gli agenti: a ogni passaggio di un’attività rileggono le istruzioni, la cronologia e i documenti precedenti, perciò il contesto ripetuto rappresenta una parte consistente del loro consumo.
Il taglio è particolarmente rilevante per chi paga a consumo, soprattutto per chi esegue un agente ospitato in proprio, come OpenClaw, usando la propria chiave API. OpenClaw permette agli utenti di scegliere il modello sottostante e, nelle automazioni lunghe, gran parte del costo è dovuta al contesto reinviato. Un ciclo senza fine continua a costare, ma la quota spesa per le letture in cache è ora dimezzata.
Se paghi a consumo, controlla che la cache dei prompt sia attiva: lo sconto riguarda solo le letture in cache. Nelle prime settimane di ogni automazione lunga, tieni d’occhio i consumi.