OpenAI એ 30 જુલાઈ, 2026 ના રોજ જાહેરાત કરી હતી કે GPT-5.6 API તેની અગાઉની આવૃત્તિ કરતા ઘણું ઓછું ખર્ચાળ હશે, જેમાં Sol, Terra અને Luna એમ ત્રણ સ્તરના મોડલ્સ (tiered models) રજૂ કરવામાં આવ્યા છે, સાથે જ કેશ્ડ રીડ્સ (cached reads) માટે ભારે ડિસ્કાઉન્ટ પણ આપવામાં આવશે.
નવું પ્રાઇસિંગ શા માટે મહત્વનું છે
GPT-5 ના લોન્ચિંગ પછીથી, કોન્વર્સેશનલ એજન્ટ્સ, રિટ્રીવલ-ઓગમેન્ટેડ જનરેશન (RAG) પાઇપલાઇન્સ અથવા મોટા પાયે ડેટા-એક્સટ્રેક્શન ટૂલ્સ બનાવનારા કોઈપણ માટે API ખર્ચ એક મોટો ખર્ચના ભાગ તરીકે રહ્યો છે. Sol, Terra અને Luna માટે અનુક્રમે પ્રતિ મિલિયન ટોકન્સ દીઠ ઇનપુટ ફી ઘટાડીને $5, $2 અને $0.20 કરીને, OpenAI ડેવલપર્સને તેમના સમગ્ર સ્ટેકને ફરીથી ડિઝાઇન કર્યા વિના તેમને જરૂરી રિઝનિંગ (reasoning) લેવલ પસંદ કરવાનો સસ્તો માર્ગ આપે છે. સૌથી વધુ બચત Terra માટે જોવા મળે છે, જે હવે જૂની ફ્લેગશિપ કિંમતના 40% પર ચાલે છે, અને Luna માટે, જે તે બેન્ચમાર્કના માત્ર 4% પર છે.
ત્રણ મોડલ્સની વિગતવાર માહિતી
| મોડલ | ઇનપુટ કિંમત (પ્રતિ 1 મિલિયન ટોકન્સ) | આઉટપુટ કિંમત (પ્રતિ 1 મિલિયન ટોકન્સ) | સામાન્ય ઉપયોગ |
|---|---|---|---|
| Sol | $5 | $30 | ઊંડું રિઝનિંગ, ચેઇન-ઓફ-થોટ કાર્યો |
| Terra | $2 | $12 | પ્રોડક્શન વર્કલોડ્સ, સંતુલિત પર્ફોર્મન્સ |
| Luna | $0.20 | $1.20 | હાઇ-વોલ્યુમ, સરળ એક્સટ્રેક્શન અથવા ક્લાસિફિકેશન |
Sol સૌથી મોંઘું છે પરંતુ સૌથી વધુ રિઝનિંગ ડેપ્થ (reasoning depth) આપે છે. Terra ને મોટાભાગની એપ્લિકેશન્સ માટે ડિફોલ્ટ તરીકે રાખવામાં આવ્યું છે, જ્યારે Luna એ "હાઇ-સ્કેલ" વિકલ્પ છે જ્યાં ખર્ચ બચાવવા માટે ડેપ્થનો ત્યાગ કરી શકાય છે.
કેશિંગ (Caching) બિલને હજુ વધુ ઘટાડે છે
OpenAI એ કેશિંગ લેયર રજૂ કર્યું છે જે રીડ ઓપરેશન્સ પર 90% ડિસ્કાઉન્ટ આપે છે. કેશ્ડ ઇનપુટ માટેના દર આ મુજબ છે:
- Sol: $0.50 / M tokens
- Terra: $0.20 / M tokens
- Luna: $0.02 / M tokens
કેશમાં લખવાનો (Writes) ખર્ચ સંબંધિત ઇનપુટ રેટના 1.25 × જેટલો છે, અને કેશ એન્ટ્રીને દૂર (evict) કરતા પહેલા ઓછામાં ઓછી 30 મિનિટ સુધી રહેવી જોઈએ.
કોન્ટેક્સ્ટ-લેન્થ (Context-length) સરચાર્જ તમને સાવધ રાખશે
જ્યારે રિક્વેસ્ટ 272 K ટોકન્સના ઇનપુટને વટાવી જાય ત્યારે API હવે સરચાર્જ લાદે છે. ઇનપુટ માટે મૂળ કિંમત બમણી થઈ જાય છે અને આઉટપુટ માટે 1.5 × વધે છે. Sol ના ઓવરેજ રેટ્સ પ્રતિ મિલિયન ટોકન્સ દીઠ $10 ઇનપુટ અને $45 આઉટપુટ તરીકે સૂચિબદ્ધ છે, જે અસામાન્ય રીતે લાંબા કોન્ટેક્સ્ટ માટે પેનલ્ટીની ગણતરી કરવાનું સરળ બનાવે છે.
ડેવલપર્સ શું ગુમાવે છે
કિંમતમાં ઘટાડો બે નોંધપાત્ર બાબતોના અભાવ સાથે આવે છે. પ્રથમ, કોઈ કાયમી ફ્રી ટિયર નથી, જેનો અર્થ છે કે રિક્વેસ્ટ ગમે તેટલી નાની હોય, તેના પર ચાર્જ લાગશે જ. બીજું, OpenAI એ હજુ સુધી GPT-5.6 માટે બેચ-એન્ડપોઇન્ટ (batch-endpoint) ડિસ્કાઉન્ટ રજૂ કર્યા નથી, જે ફીચર અગાઉના વર્ઝનમાં મોટા પાયે ઉપયોગ કરતા યુઝર્સને પ્રતિ-કોલ ખર્ચ ઘટાડવામાં મદદ કરતું હતું.
ખર્ચ કેવી રીતે ઓછો રાખવો
- યોગ્ય મોડલ પસંદ કરો: Sol નો ઉપયોગ ફક્ત એવા કાર્યો માટે કરો જેને ખરેખર ઊંડા રિઝનિંગની જરૂર હોય; મોટાભાગના પ્રોડક્શન કામ માટે Terra નો ઉપયોગ કરો; હાઇ-થ્રુપુટ અને ઓછી જટિલતા ધરાવતા કામો માટે Luna અનામત રાખો.
- કેશિંગનો ઉપયોગ કરો: પ્રોમ્પ્ટ્સ અને મધ્યવર્તી પરિણામોને સ્ટોર કરો જેનો ફરીથી ઉપયોગ કરી શકાય; 90% રીડ ડિસ્કાઉન્ટ મૂળ કિંમતના ઘટાડા કરતા પણ વધુ ફાયદાકારક હોઈ શકે છે.
- કોન્ટેક્સ્ટ લેન્થનું ધ્યાન રાખો: 2× ઇનપુટ સરચાર્જ ટાળવા માટે ખૂબ લાંબા ઇનપુટ્સને નાના ટુકડાઓમાં વિભાજિત કરો અથવા બિન-જરૂરી ભાગોને કાઢી નાખો.
- કેશ લાઇફટાઇમ પર નજર રાખો: લઘુત્તમ કેશ સમયગાળો 30 મિનિટ છે.
હવે આગળ શું
ડેવલપર્સ કોઈપણ ફેરફારો માટે સત્તાવાર પ્રાઇસિંગ પેજ પર નજર રાખવી જોઈએ, ખાસ કરીને કેશ-રાઇટ ફી અથવા કોન્ટેક્સ્ટ-લેન્થ થ્રેશોલ્ડ (thresholds) અંગે.
મુખ્ય વાત: GPT-5.6 ની સ્તરિત (tiered) પ્રાઇસિંગ અને આક્રમક કેશિંગ ડિસ્કાઉન્ટ તેને એક સસ્તું OpenAI મોડલ બનાવે છે, પરંતુ ફ્રી ટિયર અને બેચ ડિસ્કાઉન્ટના અભાવનો અર્થ એ છે કે કોઈપણ મોટા પાયે ડિપ્લોયમેન્ટ માટે કુશળ ખર્ચ-વ્યવસ્થાપન (cost-management) હજુ પણ અનિવાર્ય રહેશે.
