Hugging Face تعداد ۲۰۷ هسته WebGPU را منتشر کرده است که به توسعه‌دهندگان اجازه می‌دهد مدل‌های هوش مصنوعی را مستقیماً در یک مرورگر وب اجرا کنند. این هسته‌ها نویدبخش استنتاج سریع‌تر، عملکرد آفلاین و ماندگاری داده‌ها روی دستگاه کاربر هستند.

چرا اجرای هوش مصنوعی در مرورگر اهمیت دارد

بیشتر سرویس‌های هوش مصنوعی روی سرورهای از راه دور قرار دارند. شما یک پرامپت را تایپ می‌کنید، متن از طریق شبکه منتقل می‌شود، یک پردازنده در مرکز داده آن را پردازش می‌کند و پاسخ به سمت شما جریان می‌یابد. این ساختار به ارائه‌دهندگان کنترل کامل بر سخت‌افزار، قیمت‌گذاری و پشته نرم‌افزاری می‌دهد. همچنین هر پرس‌وجو را از طریق یک خط لوله شخص ثالث عبور می‌دهد و ورودی‌های خام را در معرض هرگونه ثبت وقایعی (logging) که ارائه‌دهنده اجرا می‌کند، قرار می‌دهد.

یک هسته مبتنی بر مرورگر، این خط لوله را از هم می‌پاشد. محاسبات مدل روی همان ماشینی انجام می‌شود که نتیجه را نمایش می‌دهد، که این امر باعث کاهش شدید تأخیر و حذف گام‌های شبکه می‌شود. اگر اتصال به مرکز داده قطع شود، استنتاج همچنان اجرا می‌شود. توسعه‌دهندگان می‌توانند از همان مرورگر به عنوان بستری برای آزمایش عملکرد روی GPUهای مختلف استفاده کنند، در حالی که کاربران دقیقاً می‌بینند کدام سخت‌افزار داده‌های آن‌ها را پردازش می‌کند.

بسته فنی

هر یک از این ۲۰۷ هسته با یک قرارداد نسخه‌بندی‌شده عرضه می‌شود که ورودی‌ها و خروجی‌های مورد انتظار، مجموعه‌ای از موارد صحت‌سنجی برای تأیید رفتار شیدر (shader)، داده‌های بنچمارک برای نمایش عملکرد روی GPUهای مختلف و قالب‌های شیدر قابل استفاده مجدد که توسعه‌دهندگان می‌توانند آن‌ها را تغییر دهند، ارائه می‌دهد.

مزایایی فراتر از سرعت

  • استنتاج با اولویت حریم خصوصی – داده‌ها هرگز از دستگاه کاربر خارج نمی‌شوند، که این امر سطح حمله برای شنود یا استخراج داده‌ها توسط ارائه‌دهندگان ابری را کاهش می‌دهد.
  • قابلیت آفلاین – اپلیکیشن‌ها در شرایط اینترنت ناپایدار یا قطع‌شده به کار خود ادامه می‌دهند که این یک مزیت بزرگ برای کار از راه دور، استقرار در مناطق عملیاتی و پاسخ به بحران‌ها است.
  • دموکراتیزه کردن سخت‌افزار – هر مرورگری که از WebGPU پشتیبانی کند، می‌تواند از همان بلوک‌های اولیه هوش مصنوعی استفاده کند و قراردادهای پرهزینه با سرور را حذف نماید.

این مزایا با تقاضای رو به رشد برای «آزادی هوش مصنوعی» همسو است – یعنی توانایی اجرای عامل‌های هوشمند بدون اجاره قدرت پردازشی از تعداد محدودی شرکت بزرگ.

نیمه تاریک: ریسک‌های جدید

اجرای محلی همچنین مانع را برای بازیگران مخرب کاهش می‌دهد. یک مدل مخرب می‌تواند به شکل یک افزونه مرورگر یا یک صفحه وب ایستا ظاهر شود و بی‌صدا روی دستگاه قربانی اجرا شود و هر دستگاه متصل را به یک موتور استنتاج تبدیل کند. مکانیزم‌های رضایت‌گیری اغلب به چک‌باکس‌های بدون بررسی محدود می‌شوند و سرعت استنتاج روی دستگاه می‌تواند نظارت گسترده را ارزان‌تر کند.

چه کسانی سود می‌برند و چه کسانی ممکن است ضرر کنند

  • توسعه‌دهندگان یک هدف کم‌هزینه و چندپلتفرمی برای ویژگی‌های هوش مصنوعی به دست می‌آورند، به‌ویژه در جایی که تأخیر و حاکمیت داده اهمیت دارد.
  • کاربران نهایی در حریم خصوصی و قابلیت آفلاین برنده هستند، اما مسئولیت بررسی و تأیید کدی که به صورت محلی اجرا می‌شود را نیز بر عهده می‌گیرند.
  • تولیدکنندگان سخت‌افزار یک حلقه بازخورد غنی‌تر دریافت می‌کنند: مرورگرهایی که خطاهای هسته را روی GPUهای خاص گزارش می‌دهند، باگ‌هایی را آشکار می‌کنند که هرگز در آزمایش‌های آزمایشگاهی ظاهر نشده بودند.

مسئله اعتماد

اگر یک مدل هوش مصنوعی روی سخت‌افزاری اجرا شود که خودتان کنترل می‌کنید، آیا این کار آن را قابل اعتمادتر می‌کند یا نبود یک ناظر مرکزی، پاسخگویی را دشوارتر می‌سازد؟ پاسخ به این سوال، نحوه بسته‌بندی هوش مصنوعی توسط توسعه‌دهندگان، نحوه تدوین سیاست‌ها توسط قانون‌گذاران و اینکه آیا وعده آزادی هوش مصنوعی به عمل تبدیل می‌شود یا خیر را تعیین خواهد کرد.

نکته کلیدی: هسته‌های مرورگر Hugging Face محاسبات را دوباره به دست کاربران بازمی‌گرداند و مسیری را برای هوش مصنوعی سریع‌تر، آفلاین و خصوصی فراهم می‌کند. همین آزادی، چالش‌های امنیتی جدیدی را نیز به همراه دارد و پاسخ اکوسیستم تعیین خواهد کرد که آیا استنتاج روی دستگاه به جریان اصلی تبدیل می‌شود یا در حد یک آزمایش محدود باقی می‌ماند.