ثغرة تسريب الأوامر في Anthropic كشفت بيانات مستخدمين لمدة أسبوع كامل.

لماذا يمثل هذا الاختراق أمراً هاماً

تتيح واجهة النموذج الخاصة بـ Anthropic للمطورين إرسال "الأوامر" (prompts) — وهي النصوص التي توجه استجابة النموذج اللغوي. في هذه الحادثة، سمح خلل في التخزين لأطراف غير مصرح لها بقراءة تلك الأوامر لمدة سبعة أيام. لم يتضمن التسريب عملية اختراق ضخمة؛ بل فتحت هفوة صغيرة في كيفية حفظ واسترجاع الأوامر الباب أمام هذا الاختراق.

ما الذي حدث بشكل خاطئ

إن الحفاظ على فصل بيانات المستخدم عن أوزان النموذج (model weights) يحد من مخاطر التعرض للاختراق. كما أن بناء سجلات التدقيق (audit trails) يساعد في اكتشاف الأنشطة غير العادية في وقت مبكر.

إجراءات فورية للشركات الناشئة في مجال الذكاء الاصطناعي

  • تعزيز أمن التعامل مع الأوامر – تعامل مع كل أمر وارد كمدخلات حساسة. قم بتشفيرها أثناء التخزين، وقيد حقوق القراءة والكتابة لتقتصر على أقل عدد ممكن من الخدمات، وتأكد من أن محرك تنفيذ النموذج هو الوحيد القادر على استرجاعها.
  • فصل بيانات المستخدم عن أوزان النموذج – قم بتخزين الأوامر في مستودع مخصص يكون منفصلاً مادياً ومنطقياً عن ملفات النموذج. هذا الفصل يقلل من نطاق الضرر (blast radius) الناتج عن أي اختراق منفرد.
  • إنشاء سجلات تدقيق – قم بتسجيل كل عملية وصول إلى مخزن الأوامر مع الطوابع الزمنية، ومعرفات المستخدمين، وعناوين الـ IP المصدرية. قم بتشغيل تحليلات في الوقت الفعلي تطلق تنبيهات عند ملاحظة أحجام قراءة غير طبيعية أو وصول من خدمات غير متوقعة.

ما يجب مراقبته لاحقاً

الخلاصة: يمكن لخلل واحد في التعامل مع الأوامر أن يتفاقم ليؤدي إلى كشف البيانات لمدة أسبوع كامل. يجب على مؤسسي شركات الذكاء الاصطناعي تطبيق نفس الصرامة في تخزين الأوامر كما يفعلون مع أي نظام آخر لبيانات المستخدمين، وإلا فسوف يكررون خطأ Anthropic المكلف.