يظهر تقرير سوء الاستخدام الصادر عن Anthropic أن الجهات السيئة حولت Claude إلى أداة إنتاج ضخم لمروجي الرسائل المزعجة (spammers)، والنشطاء، وكتاب البرمجيات الخبيثة. فبين شهري ديسمبر وأغسطس، استخدمت مجموعة ما النموذج لإنشاء مليوني رسالة من خلال 4,700 شخصية وهمية على تطبيقات المواعدة، وتقليد نبرة أحد النشطاء لخداع جهات الاتصال، وكتابة أكواد برمجية لأغراض المراقبة والأسلحة.
لماذا يكتسب هذا التقرير أهمية؟
كان النص المُنشأ بواسطة الذكاء الاصطناعي مجرد فضول للهواة في السابق. لكن البيانات الجديدة تثبت أن هذه التقنية أصبحت رخيصة بما يكفي لأتمتة العمل المتكرر الذي كان يحد سابقاً من سوء الاستخدام واسع النطاق. فبناء آلاف الهويات الوهمية وصيانتها، أو إعادة كتابة الأكواد الخبيثة بعد أن تكتشفها الأدوات الأمنية، كان يتطلب فرقاً من البشر. أما الآن، فقد قلص Claude هذه الحواجز إلى مجرد نقرات قليلة، محولاً العمل اليدوي الشاق إلى عملية آلية متكررة.
حجم المشكلة
- الرسائل المزعجة (Spam): أرسلت 4,700 شخصية وهمية مليوني رسالة ترويجية مخصصة يصعب تصفيتها.
- انتحال الشخصية: تم استنساخ أسلوب كتابة أحد النشطاء، مما سمح للمهاجمين بإرسال استغاثات مقنعة إلى شبكة معارف النشاط.
- البرمجيات الخبيثة والمراقبة: قام المستخدمون بتصدير نصوص برمجية (scripts) أنشأها Claude لتجاوز أنظمة الكشف، وأعادوا نشرها بعد كل عملية حظر.
التحول هنا هو من رسائل سيئة معزولة إلى عمليات مستمرة واسعة النطاق.
رد Anthropic
قامت Anthropic بحظر الحسابات المخالفة وإيقاف النشاط الذي تم تحديده. أدى ذلك إلى وقف التدفق المباشر من أولئك المستخدمين، لكنه لم يمحُ الأكواد أو البوتات التي أُطلقت بالفعل في الفضاء الرقمي. فبمجرد تعبئة الأداة وتوزيعها، تنتهي سيطرة المزود عليها.
ماذا يقول هذا عن سلامة الذكاء الاصطناعي
يجبر هذا التقرير على إعادة التفكير في كيفية التعامل مع الطلبات "الخطيرة". فلم تعد القائمة الثابتة للمطالبات (prompts) المحظورة تجدي نفعاً. وتدعو الملاحظات الداخلية لشركة Anthropic إلى:
- المراقبة المستمرة لأنماط الاستخدام بدلاً من الفحوصات العارضة.
- ضوابط وصول أكثر صرامة تحد من قدرة الأشخاص على تشغيل النموذج على نطاق واسع.
- محللين بشريين لرصد مجموعات من الطلبات الصغيرة التي تبدو غير ضارة، ولكنها تشكل معاً تهديداً أكبر.
المعضلة التي تواجه القادة
يمكن للضمانات الأكثر صرامة أن تعيق الأبحاث المشروعة، والنماذج الأولية السريعة، والميزات الموجهة للعملاء التي تعتمد على مخرجات الذكاء الاصطناعي المرنة. وفي المقابل، تسمح السياسات المتساهلة بتوسع سوء الاستخدام دون رقابة، مما يعرض العلامة التجارية للخطر، ويجلب التدقيق التنظيمي، ويسبب أضراراً في العالم الحقيقي. لذا، يجب على صناع القرار الموازنة بين مكاسب الإنتاجية وتكلفة سوء الاستخدام المحتمل.
نظرة إلى المستقبل
إذا استمر هذا الاتجاه، ستنتقل سلامة الذكاء الاصطناعي من كونها شاغلاً مختبرياً إلى شاغل تشغيلي. ستحتاج الشركات إلى فرق متخصصة تتعامل مع سوء استخدام النماذج كأي حادث أمني آخر؛ من خلال مراقبة السجلات، وتحديث الضوابط، والاستجابة للاختراقات في الوقت الفعلي. ويحذر تقرير سوء استخدام Claude من أن الأدوات المصممة للمساعدة يمكن أن تتحول، عند استخدامها على نطاق واسع، إلى الأسلحة ذاتها التي كان من المفترض أن تحل محلها.
