GyaanSetu AI

Wawasan AI, machine learning, dan LLM.

1317 articlesDeep, practical knowledge

MCP Berbasis Identitas Okta Mencegah Agen Melihat Alat yang Tidak Terotorisasi

Model Context Protocol berbasis identitas baru dari Okta hanya menyajikan skema alat yang diizinkan untuk digunakan oleh agen, sehingga secara drastis mengurangi konsumsi token dan biaya inferensi, sekaligus menerapkan prinsip akses hak istimewa terendah (least-privilege access) untuk alur kerja AI perusahaan.

AI · 3 min read

AI On-Device Mendapat Dorongan Saat Muse Glimmer Memungkinkan Penghobi Menjalankan Model 30B Secara Lokal

Model 30 miliar parameter milik Muse Glimmer dikuantisasi menjadi sekitar 17 GB, sehingga dapat berjalan pada GPU dengan VRAM 24 GB atau Mac Apple Silicon melalui runtime llama.cpp. Meskipun unggul untuk agen on-device, uji keamanannya menunjukkan tingkat pelanggaran yang lebih tinggi dibandingkan para pesaingnya, sehingga pengembang sebaiknya menambahkan pengamanan ekstra.

AI · 4 min read

Beta Gratis Menghemat Sekitar 3% pada Tagihan Agen Claude Anda, Bukan 14%

Header beta mengompresi output tool-call Claude, mengurangi sekitar 14% token tersebut, namun karena token output hanya sebagian kecil dari total penggunaan, sebagian besar pengguna hanya melihat pengurangan sekitar 3% pada total tagihan API mereka, ditambah sedikit peningkatan kecepatan (latensi).

AI · 3 min read

Twitch Berikan Streamer Opsi Satu Klik untuk Menolak Pelatihan AI Amazon

Tombol pengatur yang aktif secara default ini terletak di tab Keamanan dan Privasi Twitch; dengan menonaktifkannya, semua siaran langsung, VOD, klip, obrolan, dan unggahan tidak akan digunakan untuk melatih alur AI generatif Amazon, namun alat moderasi dan rekomendasi di dalam platform tetap aktif.

AI · 3 min read