Apakah Kimi K3 Adalah Produk Distilasi? Para Ahli Menyanggah Tuduhan Tersebut

Ketegangan geopolitik seputar kecerdasan buatan telah mencapai titik didih saat pejabat AS menuduh perusahaan-perusahaan Tiongkok melakukan spionase industri. Meskipun ada tuduhan bahwa Moonshot AI menggunakan Fable milik Anthropic untuk melatih model Kimi K3 miliknya, para peneliti AI terkemuka berpendapat bahwa realitas teknis dari pengembangan model bahasa besar (LLM) menceritakan kisah yang jauh lebih kompleks.

Tuduhan Distilasi Model dan Pencurian Kekayaan Intelektual (IP)

Penasihat sains Gedung Putih, Michael Kratsios, telah melontarkan tuduhan serius terhadap Moonshot, perusahaan di balik Kimi K3—saat ini merupakan LLM open-weight terbesar yang tersedia. Kratsios menuduh bahwa Moonshot terlibat dalam "distilasi industri tersembunyi berskala besar" untuk mencuri teknologi milik AS. Klaim ini didukung oleh Menteri Keuangan Scott Bessent, yang mencatat bahwa "watermark" dari LLM AS telah muncul dalam model-model Tiongkok.

Distilasi adalah proses di mana model yang lebih kecil dilatih dengan cara memberikan kueri ke model "frontier" yang lebih besar untuk mengekstrak kemampuan penalaran dan pengetahuannya. Hal ini sering kali melibatkan supervised fine-tuning (SFT), di mana prompt dan respons dari model target digunakan untuk melatih model baru, yang terkadang menyebabkan model baru tersebut mengadopsi "gaya bicara" atau keunikan percakapan spesifik dari model aslinya.

Mengapa Para Ahli Meragukan Teori Distilasi

Terlepas dari bobot politik dari klaim-klaim ini, komunitas riset AI tetap skeptis. Braden Hancock, seorang peneliti di Laude Institute dan salah satu pendiri Snorkel AI, menunjukkan masalah lini masa yang signifikan: Fable milik Anthropic baru tersedia untuk publik sejak 1 Juli. "Anda tidak bisa mendistilasi data sebanyak itu, melatih sebuah model, dan merilisnya dalam dua minggu," catat Hancock.

Selain itu, Nathan Lambert dari Allen Institute for AI berpendapat bahwa distilasi melalui SFT menjadi kurang efektif seiring dengan bergeraknya model-model menuju tingkat frontier. Untuk mencapai tingkat performa yang terlihat pada Kimi K3, sebuah model kemungkinan besar akan membutuhkan proses reinforcement learning (RL) yang masif. Proses ini membutuhkan puluhan juta agen untuk menilai respons—sebuah tugas yang akan sangat mahal dan lambat jika dilakukan melalui API kompetitor.

Peran Perangkat Keras dan Keahlian Teknis

Kontroversi ini tidak terbatas pada perangkat lunak saja. Kratsios juga menuduh bahwa Moonshot melangkahi kontrol ekspor untuk mengakses perangkat keras Nvidia yang canggih, secara khusus menyebutkan chip Grace Blackwell 300 dan server yang dilengkapi GB300. Meskipun chip ini dilarang untuk diekspor ke Tiongkok, para ahli seperti Sam Bresnick dari Georgetown menyarankan bahwa pasar gelap dan rantai pasokan global yang kompleks membuat pemantauan aliran perangkat keras ini menjadi sangat sulit.

Namun, banyak peneliti berpendapat bahwa fokus pada distilasi merusak legitimasi teknis dari tim AI Tiongkok. Dengan para pendiri yang berasal dari institusi elit seperti Carnegie Mellon University, para ahli menyarankan bahwa Moonshot mampu melakukan riset orisinal alih-alih hanya "menumpang keberhasilan" pihak lain.

Implikasi bagi Persaingan AI Global

Perselisihan ini menyoroti kesenjangan yang semakin lebar antara narasi politik dan realitas teknis. Seiring industri bergerak menuju reinforcement learning yang canggih dan kebutuhan komputasi yang masif, perdebatan mengenai apakah perusahaan-perusahaan "mencuri" kecerdasan atau sekadar maju melalui rekayasa yang unggul akan terus membentuk kebijakan perdagangan internasional dan regulasi AI.

Poin-Poin Penting

  • Skeptisisme Teknis: Para ahli berpendapat bahwa rilis cepat Kimi K3 membuatnya secara matematis tidak mungkin dibangun semata-mata melalui distilasi dari Fable milik Anthropic.
  • Melampaui Fine-Tuning: Meskipun distilasi melalui supervised fine-tuning itu ada, mencapai performa tingkat frontier kemungkinan besar membutuhkan reinforcement learning tingkat lanjut yang tidak dapat dengan mudah "ditiru."
  • Kekhawatiran Perangkat Keras: Tuduhan akses ilegal ke chip Nvidia Blackwell yang dilarang menambah lapisan kompleksitas geopolitik dalam perdebatan mengenai kemajuan AI Tiongkok.