האם Kimi K3 הוא תוצר של זיקוק (Distillation)? מומחים מערערים על ההאשמות

המתח הגיאופוליטי סביב בינה מלאכותית הגיע לנקודת רתיחה, כאשר גורמים רשמיים בארה"ב מאשימים חברות סיניות בריגול תעשייתי. בעוד שהאשמות גורסות כי Moonshot AI השתמשה ב-Fable של Anthropic כדי לאמן את מודל ה-Kimi K3 שלה, חוקרי בינה מלאכותית מובילים טוענים כי המציאות הטכנית של פיתוח מודלי שפה גדולים (LLM) מספרת סיפור מורכב הרבה יותר.

האשמות על זיקוק מודלים וגניבת קניין רוחני

יועץ המדע של הבית הלבן, מייקל קרציוס, הטיח האשמות חמורות נגד Moonshot, החברה שעומדת מאחורי Kimi K3 — כיום ה-LLM בעל המשקלים הפתוחים (open-weight) הגדול ביותר הזמין. קרציוס טוען כי Moonshot עסקה ב"זיקוק תעשייתי סמוי ורחב היקף" כדי לגנוב טכנולוגיה אמריקאית קניינית. טענה זו נתמכת על ידי שר האוצר סקוט בסנט, שציין כי "סימנים מים" (watermarks) של LLMs אמריקאיים מופיעים במודלים סיניים.

זיקוק (Distillation) הוא תהליך שבו מאמנים מודל קטן יותר באמצעות שליחת שאילתות למודל גדול יותר מסוג "frontier" כדי לחלץ את יכולות ההסקה והידע שלו. תהליך זה כולל לעיתים קרובות כוונון עדין מונחה (SFT - supervised fine-tuning), שבו הנחיות (prompts) ותגובות של מודל יעד משמשות לאימון המודל החדש, מה שגורם לעיתים למודל החדש לאמץ את ה"נימוסים" או את המוזרויות השיחתיות הספציפיות של המקור.

מדוע מומחים מטילים ספק בתיאוריית הזיקוק

למרות המשקל הפוליטי של טענות אלו, קהילת מחקר הבינה המלאכותית נותרה סקפטית. בריידן הנקוק, חוקר במכון Laude ומייסד שותף של Snorkel AI, מצביע על בעיית לוח זמנים משמעותית: Fable של Anthropic זמין לציבור רק מאז ה-1 ביולי. "אי אפשר לזקק כמות כזו של נתונים, לאמן מודל ולהשיק אותו בשבועיים," ציין הנקוק.

יתרה מכך, נתן למברט מהמכון Allen Institute for AI טוען כי זיקוק באמצעות SFT הופך לפחות יעיל ככל שהמודלים מתקדמים לעבר רמת ה-frontier. כדי להשיג את רמת הביצועים הנראית ב-Kimi K3, מודל יזדקק ככל הנראה להרצות ענק של למידת חיזוק (RL - reinforcement learning). תהליך זה דורש עשרות מיליוני סוכנים שידרגו תגובות — משימה שתהיה יקרה ואיטית באופן בלתי סביר אם תבוצע באמצעות API של מתחרה.

תפקידם של החומרה והמומחיות הטכנית

המחלווקת אינה מוגבלת לתוכנה בלבד. קרציוס טען גם כי Moonshot עקפה בקרות ייצוא כדי לגשת לחומרת Nvidia מתקדמת, תוך ציון ספציפי של שבבי Grace Blackwell 300 ושרתים המצוידים ב-GB300. בעוד שייצוא שבבים אלו לסין אסור, מומחים כמו סם ברסניק מאוניברסיטת ג'ורג'טאון מצביעים על כך ששווקים שחורים ושרשראות אספקה גלובליות מורכבות הופכים את הניטור של זרמי חומרה אלו לקשה ביותר.

עם זאת, חוקרים רבים טוענים כי ההתמקדות בזיקוק פוגעת בלגיטימיות הטכנית של צוותי ה-AI הסיניים. עם מייסדים שמגיעים ממוסדות עילית כמו אוניברסיטת Carnegie Mellon, מומחים מציעים כי Moonshot מסוגלת לבצע מחקר מקורי ולא רק "לרכוב על גבם" של אחרים.

השלכות על מרוץ ה-AI העולמי

מחלוקת זו מדגישה פער הולך וגדל בין נרטיבים פוליטיים למציאות טכנית. ככל שהתעשייה נעה לעבר למידת חיזוק מתוחכמת ודרישות מחשוב (compute) עצומות, הוויכוח בשאלה האם חברות "גונבות" אינטליגנציה או פשוט מתקדמות באמצעות הנדסה עדיפה, ימשיך לעצב את מדיניות הסחר הבינלאומית ואת הרגולציה על בינה מלאכותית.

נקודות מפתח

  • ספקנות טכנית: מומחים טוענים כי ההשקה המהירה של Kimi K3 הופכת את האפשרות שהוא נבנה אך ורק באמצעות זיקוק של Fable של Anthropic לבלתי סבירה מבחינה מתמטית.
  • מעבר לכוונון עדין: בעוד שזיקוק באמצעות כוונון עדין מונחה קיים, השגת ביצועים ברמת frontier דורשת ככל הנראה למידת חיזוק מתקדמת שלא ניתן "להעתיק" בקלות.
  • חששות בנוגע לחומרה: האשמות בדבר גישה בלתי חוקית לשבבי Nvidia Blackwell האסורים מוסיפות רובד של מורכבות גיאופוליטית לוויכוח על התקדמות ה-AI הסינית.