Z.ai در ۱۴ اوت اعلام کرد که مدل جدید GLM-5.3 آن برخلاف وعده قبلی، با وزن‌های باز (open weights) عرضه نخواهد شد. این شرکت مدل را برای دو هفته دیگر از طریق API و سرویس اشتراکی در دسترس نگه می‌دارد و انتشار عمومی آن را به حدود ۲۸ اوت موکول می‌کند تا در این مدت بررسی‌های امنیتی را انجام دهد. Z.ai می‌گوید این تأخیر ناشی از توانایی‌های غیرمنتظره و قدرتمند مدل در زمینه امنیت تهاجمی (offensive-security) است؛ مهارت‌هایی که اگر مدل به صورت رایگان قابل دانلود باشد، می‌تواند به سلاحی تبدیل شود.

چرا این تعویق اهمیت دارد

GLM-5.3 به عنوان متخصص در کدنویسی، وظایف عامل‌محور با بازه زمانی طولانی (long-horizon agent tasks) و امنیت سایبری معرفی شده است. در نسخه‌های قبلی، Z.ai وزن‌های مدل را بلافاصله در دسترس قرار می‌داد و بدین ترتیب توسعه‌دهندگانی را که مدل‌های زبانی بزرگ را روی سخت‌افزار خود اجرا می‌کنند، جذب می‌کرد. این بار، دکمه «به‌زودی» (Coming Soon) در صفحه دانلود جایگزین لینک دسترسی فوری شده است که نشان‌دهنده تغییر رویکرد از باز بودن به احتیاط است.

تیم ایمنی پس از آنکه آزمایش‌های داخلی نشان داد مدل با سرعتی بیش از حد انتظار، مهارت‌های امنیت تهاجمی را کسب کرده است، نسبت به آن هشدار داد. Z.ai این توقف را یک اقدام مسئولانه توصیف می‌کند: یک بررسی دو هفته‌ای برای ارزیابی خطر سوءاستفاده، پیش از آنکه کسی بتواند وزن‌ها را کپی کرده و مدل را به‌صورت آفلاین اجرا کند.

گرایش گسترده‌تر صنعت به سمت انتشارهای محافظه‌کارانه

Z.ai در محدود کردن دسترسی به توانمندترین عامل‌های خود تنها نیست. اقدامات اخیر سه آزمایشگاه پیشرو دیگر نشان‌دهنده یک اجماع فزاینده است مبنی بر اینکه توزیع بدون محدودیت مدل‌های قدرتمند و ابزار-محور، خطرات واقعی به همراه دارد.

  • OpenAI اکنون برای استفاده از مدل متمرکز بر امنیت سایبری خود، احراز هویت را الزامی کرده و دسترسی به پرس‌وجو (query) آن را محدود کرده است.
  • Anthropic آخرین مدل با عملکرد بالای خود را در داخل سازمان نگه داشته و آن را تنها از طریق رابط‌های کنترل‌شده ارائه می‌دهد.

این اقدامات نشان می‌دهند که تمرکز صنعت از کسب امتیازات خیره‌کننده در بنچمارک‌ها، به سمت توانایی مدل‌ها در اجرای برنامه‌های چندمرحله‌ای، کار با ابزارهای خارجی و بازیابی از خطاها تغییر یافته است؛ قابلیت‌هایی که عوامل مخرب را نیز به خود جذب می‌کند.

آنچه در خطر است

اگر وزن‌ها در نهایت تحت یک مجوز منعطف مانند MIT منتشر شوند، محققان امنیتی می‌توانند تکنیک‌های مدل را مطالعه کنند، اقدامات مقابله‌ای توسعه دهند و این فناوری را در ابزارهای دفاعی بگنجانند. انتشار متن‌باز (open-source) این اصل را تقویت می‌کند که شفافیت به جامعه کمک می‌کند تا از تهدیدات جلوتر بماند.

در مقابل، یک مجوز محدودکننده‌تر نشان‌دهنده این خواهد بود که حتی حامیان مدل‌های با وزن باز نیز نیاز به محدود کردن افرادی که می‌توانند مدل را اجرا کنند، احساس می‌کنند. این امر می‌تواند یک الگو ایجاد کند و این حوزه را به سمت اقتصاد «دسترسی از طریق API» سوق دهد.

تنش اصلی همچنان پابرجاست: زمانی که فایل یک مدل به‌صورت عمومی منتشر شود، ناشر هرگونه توانایی برای جلوگیری از سوءاستفاده مخرب را از دست می‌دهد. یک بررسی امنیتی دو هفته‌ای نمی‌تواند این تضاد را از بین ببرد، اما زمانی را برای تدوین دستورالعمل‌ها، گنجاندن کنترل‌های استفاده یا اصلاح مجوزها فراهم می‌کند.

آنچه باید در ۲۸ اوت زیر نظر داشت

دو پرسش مشخص، فصل بعدی GLM-5.3 را تعیین خواهد کرد:

  1. آیا وزن‌ها واقعاً طبق برنامه عرضه می‌شوند؟ از دست دادن ضرب‌الاجل می‌تواند نشان‌دهنده موانع فنی یا سیاستی عمیق‌تر باشد که احتمالاً Z.ai را وادار به تمدید دوره بررسی می‌کند.
  2. چه مجوزی همراه با انتشار خواهد بود؟ باقی ماندن مجوز MIT یک پیروزی برای رویکرد باز خواهد بود؛ اما تغییر به سمت یک مجوز محافظه‌کارانه، نشان‌دهنده کنترل فزاینده صنعت بر مدل‌های عامل‌محور (agentic models) خواهد بود.

توسعه‌دهندگانی که برنامه‌ریزی برای تحقیقات مرتبط با امنیت را دارند، باید آماده باشند تا پس از رسیدن وزن‌ها، مدل را در یک وظیفه تهاجمی در دنیای واقعی آزمایش کنند. این کار مشخص خواهد کرد که آیا تأخیر صرفاً یک اقدام احتیاطی بوده یا سیگنالی است مبنی بر اینکه توانایی‌های مدل واقعاً از ابزارهای دفاعی فعلی پیشی گرفته است.

خلاصه کلام

تصمیم Z.ai برای نگه داشتن وزن‌های GLM-5.3 یک نقطه عطف است: مدل‌های زبانی قدرتمند و ابزار-محور دیگر تنها به دلیل ظرافت در گفتگو مورد توجه نیستند، بلکه به دلیل گستره اقداماتی که می‌توانند خودکارسازی کنند، ارزشمند شده‌اند. با اولویت دادن آزمایشگاه‌های بیشتر به عملکرد عامل‌محور، خطر استفاده از این توانایی‌ها علیه مدافعان افزایش می‌یابد. هفته‌های آینده نشان خواهد داد که آیا جامعه می‌تواند بین تحقیقات باز و نیاز به مهار سوءاستفاده تعادل برقرار کند، و آیا یک مجوز منعطف می‌تواند در دنیایی که در آن «وزن‌های باز» ممکن است به همان اندازه که یک دارایی است، به یک ریسک نیز تبدیل شود، دوام بیاورد یا خیر.