OpenAI lançou GPT-6.1 Sol em 29 September, junto com Dots, e afirma que o modelo quase iguala os resultados de Astra por uma fração do custo, segundo The Decoder. As tarifas padrão não mudaram em relação a GPT-6 Sol: um milhão de tokens de entrada custa $2, e um milhão de tokens de saída, $10. Portanto, para o uso comum em conversas, nada muda na conta.
A mudança está na entrada em cache, que caiu para $0.10 por milhão de tokens, metade dos $0.20 anteriores, segundo FourWeekMBA e The Decoder. O cache se aplica quando um modelo recebe o mesmo material novamente, exatamente como acontece com agentes: a cada etapa de uma tarefa, eles leem de novo as instruções, o histórico e os documentos anteriores. Por isso, o contexto repetido representa boa parte do que consomem.
O corte é mais importante para quem paga por token, sobretudo para quem executa um agente auto-hospedado, como OpenClaw, usando sua própria chave de API. OpenClaw permite escolher o modelo usado, e, em automações longas, a maior parte do custo vem do contexto enviado repetidamente. Um loop fora de controle ainda custa dinheiro, mas a parcela gasta com leituras em cache agora é metade do que era.
Quem paga por token deve confirmar se o cache de prompts está ativado, pois o desconto vale apenas para leituras em cache. Acompanhe o uso nas primeiras semanas de qualquer automação longa.