1. Unang pahina
  2. Balita
  3. Hinahati sa dalawa ng GPT-6.1 Sol ang presyo ng cached input, kaya mas mura ang mahahabang gawain ng agent
Mga presyo

Hinahati sa dalawa ng GPT-6.1 Sol ang presyo ng cached input, kaya mas mura ang mahahabang gawain ng agent

Nananatili sa $2 para sa input at $10 para sa output kada milyong token ang mga karaniwang presyo, pero kalahati na lang ang bayad sa paulit-ulit na kontekstong ginagamit ng mga agent.

Inilabas ng OpenAI ang GPT-6.1 Sol noong 29 September, kasabay ng paglulunsad ng Dots. Ayon sa ulat ng The Decoder, sinasabi ng OpenAI na halos kapantay na nito ang resulta ng Astra sa mas mababang halaga. Hindi nagbago ang karaniwang presyo mula sa GPT-6 Sol: $2 ang isang milyong input token at $10 ang isang milyong output token. Kaya walang magbabago sa singil para sa karaniwang pakikipag-chat.

Ang nagbago ay ang presyo ng cached input, na bumaba sa $0.10 kada milyong token—kalahati ng dating $0.20—ayon sa FourWeekMBA at The Decoder. Ginagamit ang caching kapag paulit-ulit na ipinapasok sa modelo ang parehong materyal, at ganyan mismo gumagana ang mga agent: sa bawat hakbang ng isang gawain, binabasa nilang muli ang mga naunang tagubilin, kasaysayan at dokumento. Dahil dito, malaking bahagi ng ginagamit nila ang paulit-ulit na konteksto.

Pinakamahalaga ang pagbawas para sa mga nagbabayad kada token, lalo na sa mga nagpapatakbo ng self-hosted na agent gaya ng OpenClaw gamit ang sarili nilang API key. Hinahayaan ng OpenClaw ang mga user na pumili ng modelong gagamitin nito, at sa mahahabang automation, malaking bahagi ng gastos ang paulit-ulit na ipinapasang konteksto. May bayad pa rin ang isang loop na walang tigil, pero kalahati na lang ng dati ang bahaging napupunta sa cached reads.

Ano ang kahulugan nito para sa iyo

Kung kada token ang bayad mo, tiyaking naka-enable ang prompt caching, dahil cached reads lang ang saklaw ng diskuwento. Subaybayan ang paggamit sa mga unang linggo ng anumang mahabang automation.

Mga pinagmulan