כיצד ארגוני טרור מנצלים מודלי שפה גדולים (LLMs) לצורך פיתוח אמלצות ותכנון
הדמוקרטיזציה המהירה של מודלי שפה גדולים (LLMs) הביאה תועלת עצומה לאנושות, אך מחקר חדש ומצמרר חושף צד אפל יותר של זינוק טכנולוגי זה. ארגוני טרור מנצלים כעת באופן פעיל כלי בינה מלאכותית (AI) נפוצים כדי להפוך אותם לנשק ולו להגברת היכולות המבצעיות שלהם, מתרגול טקטי ועד לפיתוח חומרי נפץ.
מפריצת הגנות (Jailbreaking) ליחידות AI ייעודיות
מחקר חדש של החוקרת אנטוניה יוליך (Antonia Jülich) מתוכנית ה-AI Science & Policy של קיימברידג' (CASP) חשף רמה מתוחכמת של אימוץ AI בקרב קבוצות קיצוניות. באמצעות 57 ראיונות עם 27 חברים לשעבר, המחקר מגלה כי דאעש (ISIS) מציע הדרכות על הנדסת פרומפטים (prompt engineering) ופריצת הגנות (jailbreak) מאז 2023. אין מדובר רק בשימוש מזדמן; קשרי דאעש הכשילו באופן פעיל מפקדים בדרכים לעקוף את מסנני הבטיחות של המודלים המובילים בתעשייה.
המדאיג ביותר הוא שבוקו חראם עבר משימוש מזדמן לשילוב מוסדי. על פי הדיווחים, שתי הפלגות המרכזיות של הקבוצה הקימו יחידות AI ייעודיות. לדברי יוליך, קבוצות אלו מתייחסות להכשרת AI בעדיפות גבוהה, ומקבצות את "אנשי המקצוע המובילים" שלהן למפגשים ייעודיים תוך שימוש במקרנים כדי להדגים כיצד לתמרן את הכלים העוצמתיים הללו.
ניצול צ'אטבוטים מרכזיים להשגת יתרון טקטי
המחקר מדגיש כי אף שחקנית AI מרכזית אינה חסינה לשימוש לרעה זה. פלגות טרור משתמשות במגוון רחב של צ'אטבוטים פופולריים, כולל ChatGPT, Claude, Gemini, Grok, Meta AI, ו-DeepSeek. כלים אלו מנוצלים למספר פונקציות קריטיות — ומסוכנות:
- תכנון התקפות: ייעול הלוגיסטיקה והתזמון של פעולות מורדים.
- פיתוח נשק: שימוש ב-LLMs כדי להשיג תובנות לבניית מכשירי נפץ עוצמתיים יותר.
- אבטחה מבצעית: שימוש ב-AI כדי להסוות פעילויות ולשפר את אבטחת התקשורת.
- אימון טקטי: במקרה קיצוני אחד, פלגת ISWAP השתמשה ב-AI כדי לנתח ולשחזר טכניקות של קפיצות אופנוע מסרטים כדי לעבור שוחות קרב.
הכישלון של הרגולציה העצמית הוולונטרית
הממצאים משמשים כאישור קודר לאזהרות ארוכות שנים של מעבדות AI כמו OpenAI ו-Anthropic. בעוד שמפתחים הטמיעו מגבלות בטיחות (guardrails) קפדניות, המחקר מרמז כי הרגולציה העצמית הוולונטרית אינה מצליחה לעמוד בקצב של גורמים עוינים.
טבעם של מודלי ה-LLM הופך אבטחה מוחלטת לכמעט בלתי אפשרית; Anthropic הודתה לאחרונה כי לא ניתן יהיה לחסל לחלוטין את פריצות ההגנות (jailbreaks). בעוד שצ'אטבוטים נפוצים כמו ChatGPT הופכים בעיקר ידע קיים לנגיש יותר, האיום הקיומי האמיתי טמון בשימוש לרעה פוטנציאלי במערכות AI מתמחות. חוקרים מזהירים כי בעוד שהשימוש הנוכחי נותר "קונבנציונלי", הגבול הבא כולל טרוריסטים המחפשים סיוע ב-AI לפיתוח נשק כימי וביולוגי.
מדוע זה חשוב למערכת האקולוגית של ה-AI
התפתחות זו מסמנת שינוי בשיח בטיחות ה-AI. זה כבר לא רק עניין של מניעת "הזיות" (hallucinations) או פלטים מוטים; זה עוסק בקשיים הבסיסיים שבמניעת הדמוקרטיזציה של ידע קטלני. ככל שמודלי AI הופכים למיומנים יותר בתחומים מתמחים כמו מדעי החיים, הפער בין "מידע נגיש" לבין "הפיכה לנשק מעשי" ממשיך להצטמצם, מה שמחייב ארכיטקטורות אבטחה חזקות ופרואקטיביות הרבה יותר.
נקודות מפתח
- שימוש לרעה מוסדי: קבוצות כמו בוקו חראם עברו משימוש מזדמן ליצירת "יחידות AI" ייעודיות לתכנון טקטי ולוגיסטי.
- פגיעות אוניברסלית: מודלים מרכזיים, כולל ChatGPT, Claude, Gemini ו-DeepSeek, מפורצים באמצעות הנדסת פרומפטים מתוחכמת והדרכות פריצת הגנות.
- איום ההתמחות: בעוד שהשימוש לרעה הנוכחי מתמקד בתכנון ובחומרי נפץ, הסיכון העיקרי לטווח ארוך הוא שימוש ב-AI מתמחה במדעי החיים לצורך לוחמה כימית וביולוגית.
