2026 സെപ്റ്റംബർ 14-ന്, തങ്ങളുടെ V4-Pro ലാർജ് ലാംഗ്വേജ് മോഡൽ (LLM) പിൻവലിക്കുമെന്നും എല്ലാ API റിക്വസ്റ്റുകളും പുതിയ V4.1-Flash പതിപ്പിലേക്ക് മാറ്റുമെന്നും DeepSeek പ്രഖ്യാപിച്ചു.

എന്തുകൊണ്ടാണ് DeepSeek V4-Pro നിർത്തലാക്കുന്നത്?

ലോഞ്ച് ചെയ്തത് മുതൽ വിപുലമായ അറിവുള്ള ഒരു ജനറൽ പർപ്പസ് LLM ആയി വിപണനം ചെയ്ത V4-Pro ആണ് DeepSeek-ന്റെ ഏറ്റവും മികച്ച സേവനമായിരുന്നത്. കഴിഞ്ഞ ഒരു വർഷമായി, കോഡ് ജനറേഷൻ (code generation), ടെർമിനൽ കമാൻഡ് സിന്തസിസ് (terminal command synthesis), ചെറിയ പ്രോംപ്റ്റുകൾക്കുള്ള വേഗത്തിലുള്ള പ്രതികരണം എന്നിങ്ങനെ തങ്ങളുടെ API ഉപഭോക്താക്കൾക്ക് പ്രധാനപ്പെട്ട കാര്യങ്ങളിൽ V4.1-Flash-നെ V4-Pro-യുമായി കമ്പനി താരതമ്യം ചെയ്തു. പുതിയ മോഡൽ വേഗത്തിൽ പ്രവർത്തിക്കുന്നുവെന്നും, ഓരോ റിക്വസ്റ്റിനും കുറഞ്ഞ ചിലവ് വരുത്തുന്നുവെന്നും, വിവിധ ടാസ്ക്-സ്പെസിഫിക് ബെഞ്ച്മാർക്കുകളിൽ ഉയർന്ന സ്കോർ നേടുന്നുവെന്നും ഡാറ്റ കാണിക്കുന്നു.

ഈ മാറ്റം വിപണിയിലെ സമ്മർദ്ദത്തെയാണ് സൂചിപ്പിക്കുന്നത്. ക്ലൗഡ് അധിഷ്ഠിത AI സേവനങ്ങൾ ഇപ്പോൾ ഓരോ ടോക്കണിനും (token) അല്ലെങ്കിൽ കമ്പ്യൂട്ട് യൂണിറ്റിനും അനുസരിച്ചാണ് ചാർജ് ചെയ്യുന്നത്. വേഗത കുറയാതെ തന്നെ പ്രവർത്തനച്ചെലവ് കുറയ്ക്കാനുള്ള വഴികൾ ഡെവലപ്പർമാർ തേടിക്കൊണ്ടിരിക്കുകയാണ്. എല്ലാ ട്രാഫിക്കും V4.1-Flash-ലേക്ക് മാറ്റുന്നതിലൂടെ, V4-Pro പ്രവർത്തിപ്പിക്കുന്ന കൂടുതൽ ചിലവേറിയ ഇൻഫറൻസ് പൈപ്പ്‌ലൈൻ (inference pipeline) നിർത്തലാക്കാനും ആ ലാഭം ഉപഭോക്താക്കൾക്ക് ലഭ്യമാക്കാനും DeepSeek-ന് സാധിക്കും.

പ്രകടനവും ചിലവും ഒറ്റനോട്ടത്തിൽ

ബെഞ്ച്മാർക്ക് (Benchmark) V4.1-Flash V4-Pro
Terminal-Bench 2.1 (coding & command generation) 90.6 87.9
Terminal-Bench 4.0 (complex multi-step tasks) 31.2 12.4
DeepSWE v1.1 (software-engineering reasoning) 74.2 62.7

ഓരോ പരിശോധനയിലും V4.1-Flash ഉയർന്ന സ്കോർ നേടുന്നു, ചിലപ്പോൾ വലിയ വ്യത്യാസത്തോടെയാണ്. DeepSeek-ന്റെ ആഭ്യന്തര താരതമ്യങ്ങൾ അനുസരിച്ച്, കോഡിംഗിന് മുൻഗണന നൽകുന്ന ഇതേ ബെഞ്ച്മാർക്കുകളിൽ Claude Opus 5, GPT-5.6 Sol എന്നിവയേക്കാളും ഈ മോഡൽ മികച്ച പ്രകടനം കാഴ്ചവെക്കുന്നു.

സാധാരണ ടാസ്ക്കുകൾക്കുള്ള ചിലവ് സമാനമായ രീതി കാണിക്കുന്നു:

  • GLM-5.3-Flash: $0.25
  • DeepSeek V4.1-Flash: $0.27
  • Moonshot Kimi K3: $2.00

വലിയതും വിലകൂടിയതുമായ മറ്റ് ഓപ്ഷനുകൾക്ക് പകരം Flash തിരഞ്ഞെടുക്കുമ്പോൾ, ഏകദേശം എട്ടിലൊന്ന് ചിലവിൽ സമാനമായ ബുദ്ധിശക്തി (intelligence) ഡെവലപ്പർമാർക്ക് ലഭ്യമാകും.

വിട്ടുവീഴ്ചകൾ: കുറഞ്ഞ എൻസൈക്ലോപീഡിക് അറിവ്

കാര്യക്ഷമത വർദ്ധിക്കുമ്പോൾ വസ്തുതാപരമായ ഓർമ്മശക്തിയിൽ (factual recall) കുറവുണ്ടാകുന്നു. SimpleQA-Verified ഫാക്ട് ചെക്കിംഗ് ബെഞ്ച്മാർക്കിൽ V4.1-Flash 42.3 സ്കോർ ചെയ്തപ്പോൾ V4-Pro 55.2 രേഖപ്പെടുത്തി. പുതിയ മോഡലിനെ "മികച്ച ഒരു തൊഴിലാളി എന്നാൽ ദുർബലമായ ഒരു എൻസൈക്ലോപീഡിയ" എന്നാണ് DeepSeek വിശേഷിപ്പിക്കുന്നത്. വാർത്താ സംഗ്രഹം (news summarisation), നിയമ ഗവേഷണം (legal research) എന്നിങ്ങനെ ലോകത്തെക്കുറിച്ചുള്ള ഏറ്റവും പുതിയ അറിവുകളെ വളരെയധികം ആശ്രയിക്കുന്ന ആപ്ലിക്കേഷനുകൾക്ക് പുറമെ നിന്നുള്ള നോളജ് ബേസുകളോ (knowledge bases) അല്ലെങ്കിൽ വലിയ മോഡലുകളോ ആവശ്യമായി വന്നേക്കാം.

വ്യവസായം സ്വയം എങ്ങനെയാണ് നിലകൊള്ളുന്നത്?

DeepSeek-ന്റെ ഈ നീക്കം മറ്റ് AI പ്രൊവൈഡർമാരിൽ നിന്ന് വ്യത്യസ്തമാണ്:

  • Z.ai ചെറിയ മോഡലുകൾ മുതൽ വലിയ മോഡലുകൾ വരെയുള്ള ഒരു നിര തന്നെ വാഗ്ദാനം ചെയ്യുന്നു, ഇത് ഓരോ പ്രോജക്റ്റിലും സ്കെയിലും കാര്യക്ഷമതയും സന്തുലിതമാക്കാൻ ഉപഭോക്താക്കളെ സഹായിക്കുന്നു.
  • Moonshot അതിന്റെ Kimi K3 മോഡലിലൂടെ വലിപ്പത്തിന് (size) കൂടുതൽ പ്രാധാന്യം നൽകുന്നു, കൂടുതൽ ശേഷിക്കായി ഉയർന്ന ചിലവ് അവർ അംഗീകരിക്കുന്നു.
  • DeepSeek എല്ലാ API റിക്വസ്റ്റുകളും Flash-ലേക്ക് മാറ്റിയിരിക്കുന്നു, വിപണി വലിപ്പത്തേക്കാൾ വേഗതയ്ക്കും വിലയ്ക്കും മുൻഗണന നൽകുമെന്ന് അവർ വിശ്വസിക്കുന്നു.

ഈ വ്യത്യസ്തമായ സമീപനങ്ങൾ വിപണി ഒരു ഏകീകൃത പാതയിൽ എത്തിയിട്ടില്ലെന്ന് കാണിക്കുന്നു. ചില ഡെവലപ്പർമാർ ഇപ്പോഴും വലിയ മോഡലുകളുടെ വിപുലമായ അറിവിന് മൂല്യം നൽകുന്നു; മറ്റുള്ളവർ വേഗതയേറിയതും കുറഞ്ഞ ചിലവിലുള്ളതുമായ പ്രതികരണങ്ങൾക്കായി അത് വിട്ടുവീഴ്ച ചെയ്യുന്നു.

ഡെവലപ്പർമാർക്കുള്ള പ്രായോഗിക നിർദ്ദേശങ്ങൾ

  1. മോഡലിന്റെ പേരോ ടോക്കൺ വിലയോ മാത്രം നോക്കി അത് തിരഞ്ഞെടുക്കരുത്. നിങ്ങൾ ചെയ്യുന്ന ജോലികളിൽ ഒരു "Flash" മോഡൽ ഒരു "Pro" മോഡലിനേക്കാൾ മികച്ച പ്രകടനം കാഴ്ചവെച്ചേക്കാം.
  2. നിങ്ങളുടെ സ്റ്റാക്കിൽ (stack) ഫ്ലെക്സിബിലിറ്റി ഉറപ്പാക്കുക. വലിയ മാറ്റങ്ങൾ വരുത്താതെ തന്നെ പ്രൊവൈഡർമാരെയോ മോഡൽ പതിപ്പുകളെയോ മാറ്റാൻ കഴിയുന്ന രീതിയിൽ നിങ്ങളുടെ സിസ്റ്റം രൂപകൽപ്പന ചെയ്യുക.
  3. സ്വന്തം ഡാറ്റ ഉപയോഗിച്ച് പരിശോധിക്കുക. പബ്ലിക് ബെഞ്ച്മാർക്കുകൾ ഒരു അടിസ്ഥാന വിവരങ്ങൾ നൽകുമെങ്കിലും, യഥാർത്ഥ ലോകത്തിലെ പ്രകടനം നിങ്ങളുടെ വർക്ക്ലോഡിനെ (workload) ആശ്രയിച്ചിരിക്കും.

ഈ ഘട്ടങ്ങൾ പാലിക്കുന്നത് LLM ഇക്കോസിസ്റ്റം മാറുന്നതിനനുസരിച്ച് ഒരു പ്രത്യേക സേവനത്തിൽ മാത്രം തളച്ചിടപ്പെടുന്നത് (lock-in) ഒഴിവാക്കാനും മികച്ച മൂല്യം ഉറപ്പാക്കാനും ടീമുകളെ സഹായിക്കും.

ഇനി ശ്രദ്ധിക്കേണ്ട കാര്യങ്ങൾ

V4-Pro പിൻവലിക്കുന്നത് കാര്യക്ഷമതയ്ക്ക് മുൻഗണന നൽകുന്ന LLM-കളിലേക്കുള്ള വ്യക്തമായ മാറ്റത്തെ സൂചിപ്പിക്കുന്നു. ഇത് "ഫ്ലാഗ്ഷിപ്പ്" (flagship) യുഗത്തിന്റെ അവസാനമാണോ അതോ അതിവേഗം മാറിക്കൊണ്ടിരിക്കുന്ന വിപണിയുടെ പുതിയൊരു ഘട്ടത്തിന്റെ തുടക്കമാണോ എന്ന് കണ്ടറിയേണ്ടതുണ്ട്, എങ്കിലും സാഹചര്യങ്ങൾക്കനുസരിച്ച് മാറാൻ തയ്യാറുള്ള ഡെവലപ്പർമാർക്ക് ഈ മാറ്റത്തിൽ നിന്ന് മികച്ച നേട്ടമുണ്ടാക്കാൻ സാധിക്കും.