Google telah menghabiskan beberapa minggu kebelakangan ini untuk melengkapkan barisan Gemini dengan mesej yang jelas: kelajuan dan pengkhususan adalah sama pentingnya dengan kuasa mentah. Syarikat itu telah melancarkan tiga varian Flash baharu, yang masing-masing dilaraskan untuk segmen pasaran pembangun yang berbeza. Namun, di sebalik momentum tersebut, satu tempat masih kosong. Model utama Gemini 3.5 Pro masih belum dilancarkan kepada umum, dan pesaing tidak menunggu lama.
Gemini 3.6 Flash: Menukar Kuasa Mentah dengan Kecekapan Kos
Fokus utama pengumuman ini ialah Gemini 3.6 Flash. Google mereka bentuk model ini untuk melakukan pertukaran yang akan diterima dengan senang hati oleh ramai pembangun. Ia mengorbankan prestasi mentah puncak demi peningkatan drastik dalam kelajuan dan kos. Bagi pasukan yang menjalankan ejen autonomi, API berkapasiti tinggi, atau saluran kandungan berskala besar, pertukaran tersebut sering kali menjadi perbezaan antara produk yang menguntungkan dan produk eksperimental.
Peningkatan kecekapan adalah nyata. Menurut Artificial Analysis Index, 3.6 Flash dijangka menggunakan kira-kira 17 peratus kurang token output berbanding pendahulunya, 3.5 Flash. Dalam penanda aras khusus seperti DeepSWE, Google mendakwa penjimatan token boleh meningkat sehingga 65 peratus. Apabila anda membayar mengikut token dan memproses berjuta-juta permintaan sehari, peratusan tersebut diterjemahkan secara langsung kepada bajet.
Harga mencerminkan fokus terhadap kebolehcapaian tersebut. Token input berharga $1.50 bagi setiap satu juta, manakala token output berharga $7.50 bagi setiap satu juta. Ejen sokongan pelanggan atau pemb
