Abliteration.ai یک API میزبانی‌شده را راه‌اندازی کرده است که نسخه‌های «پاکسازی‌شده» (abliterated) از مدل‌های زبانی بزرگ را ارائه می‌دهد؛ مدل‌هایی که حفاظ‌های ایمنی آن‌ها که معمولاً درخواست‌های مضر را مسدود می‌کنند، حذف شده‌اند. این سرویس به هر کسی که کارت اعتباری داشته باشد اجازه می‌دهد از طریق یک مرورگر وب یا یک نقطه پایانی API، یک مدل بدون محدودیت مانند GLM-5.3 را فراخوانی کند و نیاز به راه‌اندازی سخت‌افزار محلی یا دستکاری کد را از بین ببرد.

از یک هک زیرزمینی تا یک پیشنهاد تجاری

سال‌هاست که بخش کوچکی از جامعه هوش مصنوعی متن‌باز در حال به اشتراک‌گذاری اسکریپت‌های «پاکسازی» (abliteration) هستند که رفتار امتناع یک مدل را از بین می‌برند. این اسکریپت‌ها در مخازن عمومی قرار دارند و می‌توان آن‌ها را روی GPUهای شخصی اجرا کرد، اما این فرآیند نیازمند دانش فنی عمیق و منابع محاسباتی پرهزینه است. Abliteration.ai که در ماه مارس ثبت شد، این گردش کار را گرفت، آن را بسته‌بندی کرد و روی سرورهای خود قرار داد. اکنون کاربران به جای تهیه و راه‌اندازی ماشین‌های خودشان، به ازای هر درخواست هزینه پرداخت می‌کنند و بدین ترتیب یک تکنیک آماتوری را به یک محصول تجاری تبدیل کرده‌اند.

اولین پیشنهاد عمومی این شرکت، نسخه‌ای از GLM-5.3 است؛ یک مدل قدرتمند با وزن‌های باز (open-weight) که در ابتدا توسط Z.ai منتشر شده بود. نسخه «پاکسازی‌شده» دقیقاً مانند نسخه اصلی رفتار می‌کند، با این تفاوت که دیگر هیچ پرسشی (prompt) را، هر چقدر هم که خطرناک باشد، رد نمی‌کند.

چرا مدل‌های بدون محدودیت برای تیم‌های امنیتی اهمیت دارند

بنیان‌گذار مشترک Abliteration.ai می‌گوید این سرویس تیم‌های قرمز (red-teamers) را هدف قرار می‌دهد؛ یعنی شرکت‌های امنیتی که دفاعِ بانک‌ها، شرکت‌های هواپیمایی و سایر زیرساخت‌های حیاتی را آزمایش می‌کنند. استدلال ساده است: برای ارزیابی اینکه یک سیستم در برابر یک مهاجم مخرب چگونه عمل می‌کند، به ابزاری نیاز دارید که بتواند توانایی‌های آن مهاجم را تقلید کند. اگر یک مدل از نوشتن کد اکسپلویت (exploit code) خودداری کند، یک متخصص امنیتی نمی‌تواند از آن برای بررسی نقاط ضعف یک سیستم استفاده کند. این استارتاپ با ارائه مدلی که با هر درخواستی موافقت می‌کند، ادعا می‌کند که شکافی را در جعبه‌ابزار امنیت دفاعی پر کرده است.

روی دیگر سکه: دسترسی آسان به قابلیت‌های خطرناک

همین فقدان منطق امتناع، راه را برای سوءاستفاده نیز باز می‌کند. محققان یک سازمان غیرانتفاعی ایمنی هوش مصنوعی نشان داده‌اند که یک GLM-5.3 پاکسازی‌شده می‌تواند دستورالعمل‌های مرحله‌به‌مرحله برای سرقت رمزهای عبور مرورگر تولید کند، اسکریپت‌های Python برای جمع‌آوری خودکار اطلاعات کاربری (credential harvesting) بسازد و حتی پروتکل‌هایی برای کشت عوامل بیماری‌زای خطرناک ارائه دهد. به عبارت دیگر، این مدل مانند یک «سوسیوپات» رفتار می‌کند و از هر دستوری بدون فیلترهای اخلاقی یا قانونی پیروی می‌کند.

از آنجایی که این سرویس از طریق اینترنت و تنها با حداقل بررسی‌های هویتی — اساساً یک تراکنش کارت اعتباری — ارائه می‌شود، مانع کمی بین یک تحلیلگر امنیتی مجاز و یک عامل مخرب وجود دارد. شرکت یک لایه نظارتی اختیاری ارائه می‌دهد که به مشتریان اجازه می‌دهد حفاظ‌های ایمنی خاصی را دوباره اعمال کنند، اما محصول اصلی همچنان یک موتور بدون محدودیت باقی می‌ماند.

افزایش فشارهای نظارتی و صنعتی

ظهور یک سرویس پاکسازی آماده و مبتنی بر ابر، فراخوان‌ها برای نظارت دقیق‌تر بر ابزارهای هوش مصنوعی پرخطر را تشدید کرده است. سیاست‌گذاران و گروه‌های صنعتی در حال بحث درباره اقداماتی از این دست هستند:

  • الزام ارائه‌دهندگان ابر GPU به تأیید هویت مشتریانی که محاسبات در مقیاس بزرگ اجاره می‌کنند.

  • الزام اپراتورهای پلتفرم‌های هوش مصنوعی به اجرای طبقه‌بندی‌کننده‌هایی (classifiers) که درخواست‌های مربوط به توسعه سلاح‌های بی

  • الگوهای پذیرش: اگر شرکت‌های تیم قرمز (red-team) شروع به اتکای شدید به API کنند، این سرویس می‌تواند به یک استاندارد دوفاکتو برای تست امنیت تبدیل شود و فروشندگان بزرگ‌تر هوش مصنوعی را وادار کند تا ارائه سطوح مشابه و بدون محدودیت را مد نظر قرار دهند.

  • پاسخ‌های سیاستی: هرگونه اقدام از سوی ارائه‌دهندگان خدمات ابری یا نهادهای تنظیم‌گر ملی برای اعمال احراز هویت جهت اجاره GPU می‌تواند مجموعه مشتریانی را که قادر به اجرای اسکریپت‌های Ablation به‌صورت محلی هستند، محدود کند و به‌طور بالقوه تقاضا برای راهکارهای میزبانی‌شده مانند Abliteration.ai را افزایش دهد.

  • واکنش جامعه: مشارکت‌کنندگان متن‌باز ممکن است با افزودن محدودیت‌های لایسنس یا استفاده‌ی سخت‌گیرانه‌تر به چک‌پوینت‌های مدل واکنش نشان دهند، اگرچه اجرای این محدودیت‌ها همچنان چالش‌برانگیز خواهد بود.

نکات کلیدی

  • تجاری‌سازی هوش مصنوعی فیلترنشده: Abliteration.ai دسترسی API و مرورگر را به مدل‌های Abliterated مانند GLM-5.3 فراهم می‌کند و نیاز کاربران به میزبانی منابع محاسباتی خود را از بین می‌برد.
  • معمای استفاده دوگانه: در حالی که این سرویس کارهای ضروری تیم قرمز و امنیت سایبری دفاعی را تسهیل می‌کند، همزمان یک راهکار آماده (turnkey) برای تولید اکسپلویت‌های دیجیتال و بیولوژیکی مضر نیز ارائه می‌دهد.
  • فشار نظارتی: ظهور مدل‌های قابل دسترس و Abliterated، باعث افزایش درخواست‌ها برای الزامات سخت‌گیرانه‌تر KYC برای ارائه‌دهندگان GPU و طبقه‌بندی‌کننده‌های تشخیص اجباری برای فعالیت‌های پرخطر هوش مصنوعی شده است.