Z.ai در ۱۴ اوت اعلام کرد که مدل جدید GLM-5.3 آن برخلاف وعده قبلی، با وزنهای باز (open weights) عرضه نخواهد شد. این شرکت مدل را برای دو هفته دیگر از طریق API و سرویس اشتراکی در دسترس نگه میدارد و انتشار عمومی آن را به حدود ۲۸ اوت موکول میکند تا در این مدت بررسیهای امنیتی را انجام دهد. Z.ai میگوید این تأخیر ناشی از تواناییهای غیرمنتظره و قدرتمند مدل در زمینه امنیت تهاجمی (offensive-security) است؛ مهارتهایی که اگر مدل به صورت رایگان قابل دانلود باشد، میتواند به سلاحی تبدیل شود.
چرا این تعویق اهمیت دارد
GLM-5.3 به عنوان متخصص در کدنویسی، وظایف عاملمحور با بازه زمانی طولانی (long-horizon agent tasks) و امنیت سایبری معرفی شده است. در نسخههای قبلی، Z.ai وزنهای مدل را بلافاصله در دسترس قرار میداد و بدین ترتیب توسعهدهندگانی را که مدلهای زبانی بزرگ را روی سختافزار خود اجرا میکنند، جذب میکرد. این بار، دکمه «بهزودی» (Coming Soon) در صفحه دانلود جایگزین لینک دسترسی فوری شده است که نشاندهنده تغییر رویکرد از باز بودن به احتیاط است.
تیم ایمنی پس از آنکه آزمایشهای داخلی نشان داد مدل با سرعتی بیش از حد انتظار، مهارتهای امنیت تهاجمی را کسب کرده است، نسبت به آن هشدار داد. Z.ai این توقف را یک اقدام مسئولانه توصیف میکند: یک بررسی دو هفتهای برای ارزیابی خطر سوءاستفاده، پیش از آنکه کسی بتواند وزنها را کپی کرده و مدل را بهصورت آفلاین اجرا کند.
گرایش گستردهتر صنعت به سمت انتشارهای محافظهکارانه
Z.ai در محدود کردن دسترسی به توانمندترین عاملهای خود تنها نیست. اقدامات اخیر سه آزمایشگاه پیشرو دیگر نشاندهنده یک اجماع فزاینده است مبنی بر اینکه توزیع بدون محدودیت مدلهای قدرتمند و ابزار-محور، خطرات واقعی به همراه دارد.
- OpenAI اکنون برای استفاده از مدل متمرکز بر امنیت سایبری خود، احراز هویت را الزامی کرده و دسترسی به پرسوجو (query) آن را محدود کرده است.
- Anthropic آخرین مدل با عملکرد بالای خود را در داخل سازمان نگه داشته و آن را تنها از طریق رابطهای کنترلشده ارائه میدهد.
این اقدامات نشان میدهند که تمرکز صنعت از کسب امتیازات خیرهکننده در بنچمارکها، به سمت توانایی مدلها در اجرای برنامههای چندمرحلهای، کار با ابزارهای خارجی و بازیابی از خطاها تغییر یافته است؛ قابلیتهایی که عوامل مخرب را نیز به خود جذب میکند.
آنچه در خطر است
اگر وزنها در نهایت تحت یک مجوز منعطف مانند MIT منتشر شوند، محققان امنیتی میتوانند تکنیکهای مدل را مطالعه کنند، اقدامات مقابلهای توسعه دهند و این فناوری را در ابزارهای دفاعی بگنجانند. انتشار متنباز (open-source) این اصل را تقویت میکند که شفافیت به جامعه کمک میکند تا از تهدیدات جلوتر بماند.
در مقابل، یک مجوز محدودکنندهتر نشاندهنده این خواهد بود که حتی حامیان مدلهای با وزن باز نیز نیاز به محدود کردن افرادی که میتوانند مدل را اجرا کنند، احساس میکنند. این امر میتواند یک الگو ایجاد کند و این حوزه را به سمت اقتصاد «دسترسی از طریق API» سوق دهد.
تنش اصلی همچنان پابرجاست: زمانی که فایل یک مدل بهصورت عمومی منتشر شود، ناشر هرگونه توانایی برای جلوگیری از سوءاستفاده مخرب را از دست میدهد. یک بررسی امنیتی دو هفتهای نمیتواند این تضاد را از بین ببرد، اما زمانی را برای تدوین دستورالعملها، گنجاندن کنترلهای استفاده یا اصلاح مجوزها فراهم میکند.
آنچه باید در ۲۸ اوت زیر نظر داشت
دو پرسش مشخص، فصل بعدی GLM-5.3 را تعیین خواهد کرد:
- آیا وزنها واقعاً طبق برنامه عرضه میشوند؟ از دست دادن ضربالاجل میتواند نشاندهنده موانع فنی یا سیاستی عمیقتر باشد که احتمالاً Z.ai را وادار به تمدید دوره بررسی میکند.
- چه مجوزی همراه با انتشار خواهد بود؟ باقی ماندن مجوز MIT یک پیروزی برای رویکرد باز خواهد بود؛ اما تغییر به سمت یک مجوز محافظهکارانه، نشاندهنده کنترل فزاینده صنعت بر مدلهای عاملمحور (agentic models) خواهد بود.
توسعهدهندگانی که برنامهریزی برای تحقیقات مرتبط با امنیت را دارند، باید آماده باشند تا پس از رسیدن وزنها، مدل را در یک وظیفه تهاجمی در دنیای واقعی آزمایش کنند. این کار مشخص خواهد کرد که آیا تأخیر صرفاً یک اقدام احتیاطی بوده یا سیگنالی است مبنی بر اینکه تواناییهای مدل واقعاً از ابزارهای دفاعی فعلی پیشی گرفته است.
خلاصه کلام
تصمیم Z.ai برای نگه داشتن وزنهای GLM-5.3 یک نقطه عطف است: مدلهای زبانی قدرتمند و ابزار-محور دیگر تنها به دلیل ظرافت در گفتگو مورد توجه نیستند، بلکه به دلیل گستره اقداماتی که میتوانند خودکارسازی کنند، ارزشمند شدهاند. با اولویت دادن آزمایشگاههای بیشتر به عملکرد عاملمحور، خطر استفاده از این تواناییها علیه مدافعان افزایش مییابد. هفتههای آینده نشان خواهد داد که آیا جامعه میتواند بین تحقیقات باز و نیاز به مهار سوءاستفاده تعادل برقرار کند، و آیا یک مجوز منعطف میتواند در دنیایی که در آن «وزنهای باز» ممکن است به همان اندازه که یک دارایی است، به یک ریسک نیز تبدیل شود، دوام بیاورد یا خیر.
