OpenAI dan Anthropic telah melancarkan model terbaru yang memfokuskan kepada pembangun pada Julai 2026—GPT-5.6 daripada OpenAI dan Claude Fable 5 daripada Anthropic—masing-masing menjanjikan bantuan yang lebih pantas dan pintar pada skala besar. Angka utama adalah penting: tier termurah GPT-5.6 (Sol) berharga $5 bagi setiap 1 juta token input dan $30 bagi setiap 1 juta token output, manakala Claude Fable 5 mengenakan caj masing-masing sebanyak $10 dan $50.
Mengapa pelancaran ini penting untuk pembangun
Kedua-dua syarikat telah memposisikan model-model ini sebagai enjin generasi seterusnya untuk perisian perusahaan, pembantu sembang, dan ejen autonomi.
Landskap harga
| Tahap model | Harga input (setiap 1 J token) | Harga output (setiap 1 J token) |
|---|---|---|
| GPT-5.6 Sol | $5 | $30 |
| GPT-5.6 Terra | $2.50 | $15 |
| GPT-5.6 Luna | $1 | $6 |
| Claude Fable 5 | $10 | $50 |
Tiga tahap GPT-5.6 membolehkan pembangun menyesuaikan kos dengan intensiti beban kerja. Claude Fable 5 menawarkan satu titik harga tunggal tetapi menambah diskaun 90% untuk prompt-caching—satu mekanisme yang menyimpan prompt yang kerap digunakan untuk mengelakkan pemprosesan semula. Jika kes penggunaan anda melibatkan pertanyaan berulang, diskaun tersebut mengecilkan jurang kos, tetapi ia tidak menghapuskan kadar asas yang lebih tinggi.
Prestasi penanda aras sepintas lalu
- Kecerdasan am (Artificial Analysis Index) – Claude Fable 5 mencatatkan skor 59.9, GPT-5.6 Sol 58.9. Kedua-duanya hampir setanding dalam ujian penaakulan tulen.
- Aliran kerja profesional (Agents’ Last Exam) – GPT-5.6 Sol mencapai 53.6% berbanding 40.5% bagi Claude Fable 5. Dalam tugas pelbagai langkah yang mensimulasikan proses perniagaan dunia nyata, GPT-5.6 mendahului.
- Pengkodan dunia nyata (SWE-Bench Pro) – Claude Fable 5 mencecah 80% manakala GPT-5.6 Sol mencapai 64.6%. Untuk pangkalan kod yang besar dan prompt kejuruteraan perisian yang kompleks, Claude menunjukkan kelebihan yang jelas.
Angka-angka ini datang daripada set penanda aras awam yang menguji pelbagai aspek keupayaan model. “Artificial Analysis Index” mengukur penaakulan abstrak; “Agents’ Last Exam” menguji keupayaan model untuk merangka tindakan merentasi pelbagai alatan; “SWE-Bench Pro” menilai kualiti penjanaan kod bagi masalah pengaturcaraan dunia nyata.
Di mana setiap model menyerlah
Pilih GPT-5.6 jika anda:
- Perlu mengekalkan perbelanjaan API yang rendah, terutamanya apabila menskalakan kepada volum permintaan yang tinggi.
- Bergantung pada pelayar web atau plugin penggunaan komputer yang telah disepadukan oleh OpenAI ke dalam “ultra mode” miliknya.
- Mahu menjalankan empat ejen autonomi secara selari tanpa mencapai had siling kos.
Pilih Claude Fable 5 jika anda:
- Memerlukan sesi pengkodan autonomi yang mendalam yang boleh berjalan selama berhari-hari tanpa campur tangan manusia.
- Bekerja dengan dokumen padat, carta yang rumit, atau data yang sarat dengan rajah yang nampaknya dikendalikan dengan lebih baik oleh latihan Claude.
- Lebih gemar menggunakan sambungan asli (native hooks) ke AWS atau Google Cloud, yang telah ditekankan oleh Anthropic dalam pelancaran perusahaannya.
Langkah praktikal sebelum anda membuat komitmen
- Jalankan rintis dengan data anda sendiri. Penanda aras adalah berguna, tetapi ia tidak dapat meniru keunikan prompt, format data, dan keperluan kependaman (latency) khusus anda.
- Kos caching model adalah penting. Diskaun 90% Claude hanya terpakai untuk prompt yang disimpan dalam cache; ambil kira storan dan kadar kegagalan cache (cache-miss rate) yang anda jangkakan.
- Padankan model dengan tugas, bukan jenama. Gunakan GPT-5.6 untuk beban kerja berkapasiti tinggi yang sensitif terhadap kos; beralih ke Claude untuk tugasan yang berat dengan pengkodan atau dokumen.
Perangkap yang perlu dielakkan
- Jangan bergantung pada satu penanda aras sahaja. Setiap ujian mengasingkan satu bahagian keupayaan; model yang cemerlang dalam satu aspek mungkin ketinggalan dalam aspek yang lain.
Kesimpulan
Tiada pemenang mutlak antara GPT-5.6 dan Claude Fable 5. Pilihan bergantung pada apa yang anda paling hargai: kecekapan kos dan pelaksanaan ejen secara selari, atau penjanaan kod yang unggul dan pengendalian dokumen yang mendalam. Uji kedua-duanya terhadap beban kerja sebenar anda, ambil kira caching dan diskaun volum, dan biarkan angka yang memandu keputusan dan bukannya kesetiaan kepada jenama.
