DeepSeek mengumumkan pada 14 September 2026 bahawa ia akan menamatkan perkhidmatan model bahasa besar (LLM) V4-Pro dan mengalihkan setiap permintaan API ke versi V4.1-Flash yang lebih baharu.
Mengapa DeepSeek menghentikan V4-Pro
V4-Pro telah menjadi tawaran tahap tertinggi DeepSeek sejak pelancarannya, dipasarkan sebagai LLM serba guna dengan pengetahuan yang luas. Sepanjang tahun lalu, syarikat tersebut telah membandingkan V4.1-Flash dengan V4-Pro berdasarkan tugasan yang penting bagi pelanggan API mereka: penjanaan kod, sintesis arahan terminal, dan tindak balas pantas terhadap prom ringkas. Data menunjukkan model baharu ini berjalan lebih pantas, menelan kos yang lebih rendah bagi setiap permintaan, dan mendapat skor lebih tinggi dalam beberapa penanda aras khusus tugasan.
Peralihan ini mencerminkan tekanan pasaran. Perkhidmatan AI berasaskan awan kini mengenakan caj mengikut token atau unit pengkomputeran, dan pembangun sedang mencari jalan untuk mengurangkan perbelanjaan operasi tanpa mengorbankan kelajuan. Dengan mengalihkan semua trafik ke V4.1-Flash, DeepSeek boleh menutup saluran paip inferens yang lebih mahal yang menjana V4-Pro dan memberikan penjimatan tersebut kepada pengguna.
Prestasi dan kos sepintas lalu
| Penanda Aras | V4.1-Flash | V4-Pro |
|---|---|---|
| Terminal-Bench 2.1 (penjanaan kod & arahan) | 90.6 | 87.9 |
| Terminal-Bench 4.0 (tugasan pelbagai langkah yang kompleks) | 31.2 | 12.4 |
| DeepSWE v1.1 (penaakulan kejuruteraan perisian) | 74.2 | 62.7 |
Dalam setiap ujian, V4.1-Flash mendapat skor lebih tinggi, kadangkala dengan perbezaan yang besar. Model ini juga mengatasi Claude Opus 5 dan GPT-5.6 Sol pada penanda aras yang sama yang memfokuskan kepada pengekodan, menurut perbandingan dalaman DeepSeek.
Kos bagi tugasan tipikal menunjukkan corak yang serupa:
- GLM-5.3-Flash: $0.25
- DeepSeek V4.1-Flash: $0.27
- Moonshot Kimi K3: $2.00
Pembangun boleh mencapai tahap kecerdasan yang setanding dengan kos kira-kira satu per lapan daripada perbelanjaan apabila mereka memilih Flash berbanding alternatif yang lebih besar dan lebih mahal.
Imbalan: pengetahuan ensiklopedik yang berkurangan
Peningkatan kecekapan datang dengan penurunan dalam ingatan fakta. Pada penanda aras semakan fakta SimpleQA-Verified, V4.1-Flash mendapat skor 42.3 manakala V4-Pro mencatatkan 55.2. DeepSeek menyifatkan model baharu itu sebagai “pekerja yang lebih baik tetapi ensiklopedia yang lebih lemah.” Aplikasi yang sangat bergantung pada pengetahuan dunia terkini—seperti ringkasan berita, penyelidikan undang-undang—mungkin memerlukan pangkalan pengetahuan luaran atau sandaran kepada model yang lebih besar.
Bagaimana industri meletakkan kedudukan mereka
Langkah "all-in" DeepSeek berbeza dengan penyedia AI yang lain:
- Z.ai menawarkan pelbagai spektrum model, daripada yang kompak hingga yang besar, membolehkan pelanggan mengimbangi skala dan kecekapan bagi setiap projek.
- Moonshot memberikan tumpuan lebih kepada saiz dengan model Kimi K3 mereka, menerima kos yang lebih tinggi untuk kapasiti mentah.
- DeepSeek telah meletakkan setiap permintaan API pada Flash, dengan pertaruhan bahawa pasaran akan mengutamakan kelajuan dan harga berbanding skala semata-mata.
Pendekatan yang berbeza ini menunjukkan bahawa pasaran belum menetap pada satu jalan yang tunggal. Sesetengah pembangun masih menghargai keluasan model yang besar; yang lain menukarnya dengan tindak balas yang lebih pantas dan lebih murah.
Nasihat praktikal untuk pembangun
- Jangan pilih model semata-mata berdasarkan nama atau harga tokennya. Model “Flash” boleh mengatasi model “Pro” dalam tugasan yang anda perlukan.
- Bina fleksibiliti dalam stack anda. Reka sistem anda untuk bertukar antara penyedia atau versi model tanpa perlu penulisan semula kod yang besar.
- Sahkan dengan data anda sendiri. Penanda aras awam memberikan garis dasar yang berguna, tetapi prestasi dunia sebenar bergantung pada beban kerja anda.
Mengikuti langkah-langkah ini membantu pasukan mengelakkan kekangan vendor (lock-in) dan menjamin nilai terbaik semasa ekosistem LLM berkembang.
Apa yang perlu diperhatikan seterusnya
Penamatan V4-Pro menandakan peralihan jelas ke arah LLM yang memfokuskan kepada kecekapan. Sama ada ini akan menamatkan era “flagship” atau sekadar memulakan fasa baharu dalam pasaran yang berubah pantas masih belum dapat dipastikan, tetapi pembangun yang kekal tangkas akan berada dalam kedudukan terbaik untuk mendapat manfaat daripada perubahan ini.
