OpenAI merilis GPT-6.1 Sol pada 29 September, bersamaan dengan peluncuran Dots. Menurut The Decoder, OpenAI mengklaim model ini nyaris menyamai hasil Astra dengan biaya yang jauh lebih rendah. Tarif standar tidak berubah dari GPT-6 Sol: sejuta token input berharga $2 dan sejuta token output $10. Jadi, bagi penggunaan obrolan biasa, tagihan tidak berubah.
Perubahannya ada pada input tersimpan, yang menurut FourWeekMBA dan The Decoder turun menjadi $0.10 per sejuta token, separuh dari harga sebelumnya, $0.20. Penyimpanan sementara berlaku saat model menerima materi yang sama lagi, dan memang begitulah cara kerja agen: di setiap langkah tugas, agen membaca ulang instruksi, riwayat, dan dokumen sebelumnya. Karena itu, konteks berulang menyumbang sebagian besar konsumsi tokennya.
Pemangkasan ini paling berarti bagi orang yang membayar per token, terutama mereka yang menjalankan agen yang dihosting sendiri seperti OpenClaw dengan API key mereka sendiri. Pengguna OpenClaw dapat memilih model yang menjalankannya, dan otomatisasi panjang di sana banyak menggunakan konteks yang dikirim ulang. Perulangan yang tak terkendali tetap memakan biaya, tetapi biaya untuk membaca konteks tersimpan kini separuh dari sebelumnya.
Jika Anda membayar per token, pastikan penyimpanan sementara prompt diaktifkan karena diskon hanya berlaku untuk pembacaan yang tersimpan. Pantau penggunaan selama beberapa pekan pertama saat menjalankan otomatisasi panjang.