Hugging Face تعداد ۲۰۷ هسته WebGPU را منتشر کرده است که به توسعهدهندگان اجازه میدهد مدلهای هوش مصنوعی را مستقیماً در یک مرورگر وب اجرا کنند. این هستهها نویدبخش استنتاج سریعتر، عملکرد آفلاین و ماندگاری دادهها روی دستگاه کاربر هستند.
چرا اجرای هوش مصنوعی در مرورگر اهمیت دارد
بیشتر سرویسهای هوش مصنوعی روی سرورهای از راه دور قرار دارند. شما یک پرامپت را تایپ میکنید، متن از طریق شبکه منتقل میشود، یک پردازنده در مرکز داده آن را پردازش میکند و پاسخ به سمت شما جریان مییابد. این ساختار به ارائهدهندگان کنترل کامل بر سختافزار، قیمتگذاری و پشته نرمافزاری میدهد. همچنین هر پرسوجو را از طریق یک خط لوله شخص ثالث عبور میدهد و ورودیهای خام را در معرض هرگونه ثبت وقایعی (logging) که ارائهدهنده اجرا میکند، قرار میدهد.
یک هسته مبتنی بر مرورگر، این خط لوله را از هم میپاشد. محاسبات مدل روی همان ماشینی انجام میشود که نتیجه را نمایش میدهد، که این امر باعث کاهش شدید تأخیر و حذف گامهای شبکه میشود. اگر اتصال به مرکز داده قطع شود، استنتاج همچنان اجرا میشود. توسعهدهندگان میتوانند از همان مرورگر به عنوان بستری برای آزمایش عملکرد روی GPUهای مختلف استفاده کنند، در حالی که کاربران دقیقاً میبینند کدام سختافزار دادههای آنها را پردازش میکند.
بسته فنی
هر یک از این ۲۰۷ هسته با یک قرارداد نسخهبندیشده عرضه میشود که ورودیها و خروجیهای مورد انتظار، مجموعهای از موارد صحتسنجی برای تأیید رفتار شیدر (shader)، دادههای بنچمارک برای نمایش عملکرد روی GPUهای مختلف و قالبهای شیدر قابل استفاده مجدد که توسعهدهندگان میتوانند آنها را تغییر دهند، ارائه میدهد.
مزایایی فراتر از سرعت
- استنتاج با اولویت حریم خصوصی – دادهها هرگز از دستگاه کاربر خارج نمیشوند، که این امر سطح حمله برای شنود یا استخراج دادهها توسط ارائهدهندگان ابری را کاهش میدهد.
- قابلیت آفلاین – اپلیکیشنها در شرایط اینترنت ناپایدار یا قطعشده به کار خود ادامه میدهند که این یک مزیت بزرگ برای کار از راه دور، استقرار در مناطق عملیاتی و پاسخ به بحرانها است.
- دموکراتیزه کردن سختافزار – هر مرورگری که از WebGPU پشتیبانی کند، میتواند از همان بلوکهای اولیه هوش مصنوعی استفاده کند و قراردادهای پرهزینه با سرور را حذف نماید.
این مزایا با تقاضای رو به رشد برای «آزادی هوش مصنوعی» همسو است – یعنی توانایی اجرای عاملهای هوشمند بدون اجاره قدرت پردازشی از تعداد محدودی شرکت بزرگ.
نیمه تاریک: ریسکهای جدید
اجرای محلی همچنین مانع را برای بازیگران مخرب کاهش میدهد. یک مدل مخرب میتواند به شکل یک افزونه مرورگر یا یک صفحه وب ایستا ظاهر شود و بیصدا روی دستگاه قربانی اجرا شود و هر دستگاه متصل را به یک موتور استنتاج تبدیل کند. مکانیزمهای رضایتگیری اغلب به چکباکسهای بدون بررسی محدود میشوند و سرعت استنتاج روی دستگاه میتواند نظارت گسترده را ارزانتر کند.
چه کسانی سود میبرند و چه کسانی ممکن است ضرر کنند
- توسعهدهندگان یک هدف کمهزینه و چندپلتفرمی برای ویژگیهای هوش مصنوعی به دست میآورند، بهویژه در جایی که تأخیر و حاکمیت داده اهمیت دارد.
- کاربران نهایی در حریم خصوصی و قابلیت آفلاین برنده هستند، اما مسئولیت بررسی و تأیید کدی که به صورت محلی اجرا میشود را نیز بر عهده میگیرند.
- تولیدکنندگان سختافزار یک حلقه بازخورد غنیتر دریافت میکنند: مرورگرهایی که خطاهای هسته را روی GPUهای خاص گزارش میدهند، باگهایی را آشکار میکنند که هرگز در آزمایشهای آزمایشگاهی ظاهر نشده بودند.
مسئله اعتماد
اگر یک مدل هوش مصنوعی روی سختافزاری اجرا شود که خودتان کنترل میکنید، آیا این کار آن را قابل اعتمادتر میکند یا نبود یک ناظر مرکزی، پاسخگویی را دشوارتر میسازد؟ پاسخ به این سوال، نحوه بستهبندی هوش مصنوعی توسط توسعهدهندگان، نحوه تدوین سیاستها توسط قانونگذاران و اینکه آیا وعده آزادی هوش مصنوعی به عمل تبدیل میشود یا خیر را تعیین خواهد کرد.
نکته کلیدی: هستههای مرورگر Hugging Face محاسبات را دوباره به دست کاربران بازمیگرداند و مسیری را برای هوش مصنوعی سریعتر، آفلاین و خصوصی فراهم میکند. همین آزادی، چالشهای امنیتی جدیدی را نیز به همراه دارد و پاسخ اکوسیستم تعیین خواهد کرد که آیا استنتاج روی دستگاه به جریان اصلی تبدیل میشود یا در حد یک آزمایش محدود باقی میماند.
