OpenAI ilitangaza mnamo Julai 30, 2026 kwamba API ya GPT-5.6 itagharimu chini sana kuliko iliyopita, ikianzisha mifano mitatu ya ngazi—Sol, Terra na Luna—pamoja na punguzo kubwa kwa kusoma data zilizohifadhiwa (cached reads).

Kwa nini bei mpya ni muhimu

Tangu kuzinduliwa kwa GPT-5, gharama za API zimekuwa kipengele kikubwa cha matumizi kwa yeyote anayetengeneza mawakala wa mazungumzo (conversational agents), mifumo ya utafutaji na ujenzi wa majibu (RAG pipelines), au zana za uchimbaji wa data kwa kiwango kikubwa. Kwa kupunguza ada za kuingiza data (input fees) hadi $5, $2 na $0.20 kwa kila milioni ya tokeni kwa Sol, Terra na Luna mtawalia, OpenAI inawapa watengenezaji njia ya bei nafuu ya kuchagua kiwango cha uwezo wa kufikiri (reasoning) wanachohitaji bila kuhitaji kubadilisha mfumo wao mzima. Akiba hiyo inatokea zaidi kwa Terra, ambayo sasa inafanya kazi kwa 40% ya bei ya zamani ya kielelezo, na Luna, ambayo iko katika 4% tu ya kiwango hicho.

Mifano mitatu, kwa undani

Mfano Bei ya kuingiza (kwa kila milioni 1 ya tokeni) Bei ya kutoa (kwa kila milioni 1 ya tokeni) Matumizi ya kawaida
Sol $5 $30 Ufikiri wa kina, kazi za mfululizo wa mawazo (chain-of-thought)
Terra $2 $12 Kazi za uzalishaji, utendaji uliolingana
Luna $0.20 $1.20 Kiasi kikubwa, uchimbaji au uainishaji rahisi

Sol inabaki kuwa ghali zaidi lakini inatoa uwezo mkubwa zaidi wa ufikiri wa kina. Terra imewekwa kama chaguo la kawaida kwa programu nyingi, wakati Luna ni chaguo la "kiwango cha juu" ambapo uwezo wa ufikiri unaweza kupunguzwa ili kupunguza gharama.

Caching inapunguza bili zaidi

OpenAI imeanzisha tabaka la caching linalopunguza gharama za shughuli za kusoma kwa 90%. Viwango vya kuingiza data zilizohifadhiwa (cached input) ni:

  • Sol: $0.50 / M tokens
  • Terra: $0.20 / M tokens
  • Luna: $0.02 / M tokens

Kuandika kwenye cache kunagharimu 1.25 × kiwango kinacholingana cha kuingiza data, na ingizo la cache lazima likae angalau dakika 30 kabla ya kufutwa.

Malipo ya ziada ya urefu wa muktadha yanakuweka mkweli

API sasa inatoza malipo ya ziada wakati ombi linapozidi tokeni 272 K za kuingiza. Bei ya msingi inazidishwa mara mbili kwa kuingiza data na kuongezeka mara 1.5 kwa kutoa data. Viwango vya ziada vya Sol vimeorodheshwa kuwa $10 kwa kuingiza na $45 kwa kutoa kwa kila milioni ya tokeni, jambo linalofanya iwe rahisi kukokotoa faini kwa muktadha mrefu usio wa kawaida.

Yale watengenezaji wanayopoteza

Kupunguzwa kwa bei kunakuja na upungufu mikuu miwili. Kwanza, hakuna kiwango cha bure cha kudumu, ikimaanisha kila ombi linatozwa gharama hata kama ni ndogo kiasi gani. Pili, OpenAI bado haijatambulisha punguzo la batch-endpoint kwa GPT-5.6, kipengele ambacho kilisaidia watumiaji wa kiwango kikubwa kupunguza gharama za kila ombi katika matoleo ya awali.

Jinsi ya kudhibiti gharama

  • Chagua mfano sahihi: Tumia Sol kwa kazi zinazohitaji ufikiri wa kina pekee; tumia Terra kama chaguo la kawaida kwa kazi nyingi za uzalishaji; weka Luna kwa kazi zenye kasi kubwa lakini za utata mdogo.
  • Tumia caching: Hifadhi maelekezo (prompts) na matokeo ya kati yanayotumiwa tena katika maombi mbalimbali; punguzo la 90% la kusoma linaweza kuwa kubwa kuliko hata upunguzaji wa bei ya msingi.
  • Zingatia urefu wa muktadha: Gawanya ingizo refu sana katika vipande vidogo au kata sehemu zisizo za lazima ili kuepuka malipo ya ziada ya mara 2 ya kuingiza data.
  • Zingatia muda wa cache: Muda wa chini wa cache ni dakika 30.

Nini kinafuata

Watengenezaji wanapaswa kufuatilia ukurasa rasmi wa bei kwa marekebisho yoyote, hasa kuhusu ada za kuandika kwenye cache au viwango vya urefu wa muktadha.

Muhtasari: Bei ya ngazi za GPT-5.6 na punguzo kubwa la caching inafanya iwe mfano wa bei nafuu wa OpenAI, lakini ukosefu wa kiwango cha bure na punguzo la batch linamaanisha kuwa usimamizi mzuri wa gharama utakuwa bado ni muhimu kwa uendeshaji wowote mkubwa.