تصور کنید در حال آموزش یک شبکه عصبی کوانتومی برای تشخیص اعداد دست‌نویس هستید. شما پارامترهای مدار را تا زمانی که دقت ثابت شود، تنظیم می‌کنید. سپس وظیفه دوم را ارائه می‌دهید: طبقه‌بندی تصاویر لباس. مدل به سرعت خود را تطبیق می‌دهد. اما وقتی دوباره آن را روی اعداد آزمایش می‌کنید، عملکرد مدل فرو می‌پاشد. مدار بر آنچه آموخته بود بنا ننهاد، بلکه آن را جایگزین کرد.

این پدیده «فراموشی فاجعه‌بار» (catastrophic forgetting) نام دارد و در زمره سرسخت‌ترین مشکلات در یادگیری ماشین قرار می‌گیرد. مدل‌های کلاسیک مدام با آن دست‌وپنجه نرم می‌کنند. مدل‌های کوانتومی با نسخه حتی شدیدتری از همین معضل روبرو هستند، زیرا سازوکارهای درونی آن‌ها بر سوپرپوزیشن (superposition) و درهم‌تنیدگی (entanglement) متکی است که به محض مشاهده مستقیم، از بین می‌روند. یک رویکرد جدید و نویدبخش به نام تثبیت وزن الاستیک کوانتومی یا QEWC، با برخورد با حالت کوانتومی به عنوان یک شیء هندسی (به جای مجموعه‌ای از نتایج اندازه‌گیری کلاسیک)، این مشکل را حل می‌کند.

چرا فراموشی در مدارهای کوانتومی شدیدتر است

در هر سیستم قابل آموزشی، یادگیری از طریق تنظیم پارامترها برای کاهش خطا رخ می‌دهد. خطر اینجاست که پارامترهای بهینه دیروز، همان متغیرهای امروز هستند. وقتی یک مدل آن‌ها را برای تطبیق با وظیفه‌ای جدید بازنویسی می‌کند، اغلب پیکربندی‌های خاصی را که دانش قبلی را کدگذاری کرده بودند، پاک می‌کند. نتیجه، سیستمی است که به نظر می‌رسد به طور مداوم در حال یادگیری است، اما در واقع در حال چرخیدن میان تصاویر منزوی و گذرا از توانمندی است.

یادگیری ماشین کوانتومی این مسئله را تشدید می‌کند. رویکردهای کلاسیک برای حفظ حافظه معمولاً به مشاهده نحوه واکنش مدل به اندازه‌گیری بستگی دارند. آن‌ها در اصل می‌پرسند: «اگر به این بخش از شبکه سقلمه بزنیم و خروجی را مشاهده کنیم، چقدر تغییر می‌کند؟» این منطق فرض را بر این می‌گذارد که می‌توانید سیستم را بدون ایجاد اختلال اساسی مشاهده کنید. اما مکانیک کوانتومی چنین تضمینی نمی‌دهد. اندازه‌گیری باعث فروپاشی سوپرپوزیشن می‌شود. عملِ بررسی اینکه کدام پارامترها بیشترین اهمیت را دارند، می‌تواند دقیقاً همان حالتی را که سعی در محافظت از آن دارید، تغییر دهد.

آنچه حفاظ‌های حافظه کلاسیک نادیده می‌گیرند

هوش مصنوعی سنتی از داده‌های مهم با متصل کردن آن‌ها به آمارهای وابسته به اندازه‌گیری محافظت می‌کند. این روش‌های کلاسیک، اهمیت پارامترها را از دریچه نحوه رفتار سیستم تحت خوانش‌های (readouts) خاص دنبال می‌کنند. این روش‌ها زمانی که سخت‌افزار زیرساختی از قوانین کلاسیک پیروی می‌کند، به اندازه کافی خوب عمل می‌کنند؛ اما پردازنده‌های کوانتومی این‌گونه نیستند.

یک مدار کوانتومی، اطلاعات را در یک بردار حالت با ابعاد بالا کدگذاری می‌کند که هندسه آن از دید مستقیم پنهان است. تکیه بر اندازه‌گیری تصویر (projective measurement) برای محافظت از آن اطلاعات، مانند تلاش برای حفظ شکل یک حباب صابون با سقلمه زدن به آن است. شما مقداری داده به دست می‌آورید، اما حباب از قبل تغییر کرده است. آنچه محققان به آن نیاز داشتند، راهی برای حس کردن اهمیت بدون نگاه مستقیم به خروجی در هر بار بود.

رویکرد اطلاعات فیشر کوانتومی

اینجاست که اطلاعات فیشر کوانتومی (QFI) وارد میدان می‌شود. QFI ابزاری برگرفته از مترولوژی کوانتومی است که میزان حساسیت یک حالت کوانتومی را نسبت به تغییرات کوچک در پارامترهای زیربنایی آن اندازه‌گیری می‌کند. به جای اینکه بپرسد یک اندازه‌گیری چه چیزی را نشان می‌دهد، QFI می‌پرسد که هندسه خودِ حالت چگونه حول هر پارامتر خم می‌شود. مشخص شده است پارامترهایی که در نواحی تندِ فضای حالت قرار دارند — جایی که یک تکان کوچک باعث یک تغییر هندسی بزرگ می‌شود — همان‌هایی هستند که بیشترین دانش حیاتی مربوط به وظیفه را حمل می‌کنند.

با استفاده از QFI، محققان می‌توانند اهمیت را مستقیماً بر هندسه حالت کوانتومی نگاشت کنند. این روش برای تثبیت آنچه مهم است، به هیچ پایه اندازه‌گیری خاصی نیاز ندارد. این روش به حالت به عنوان یک سطح نگاه می‌کند و تپه‌هایی را که نباید صاف شوند، شناسایی می‌کند.

چگونه QEWC از دانش محافظت می‌کند

تثبیت وزن الاستیک کوانتومی (QEWC) آن بینش هندسی را به یک پروتکل آموزشی تبدیل می‌کند. این فرآیند را می‌توان به مراحل ملموس زیر تقسیم کرد:

  • شناسایی پارامترهای حیاتی. پس از یادگیری اولین وظیفه، QEWC اطلاعات فیشر کوانتومی را در سراسر پارامترهای مدار محاسبه می‌کند. امتیازهای بالا، چرخش‌ها و درهم‌تنیدگی‌های خاصی را که دانش حیاتی را ذخیره می‌کنند، علامت‌گذاری می‌کنند.

  • قفل کردن بخش‌های مهم. در طول آموزش‌های بعدی، QEWC جریمه‌ای را برای تغییر در آن پارامترهای با QFI بالا اعمال می‌کند. مدار برای بازنویسی آنچه از قبل می‌داند، هزینه پرداخت می‌کند.

  • آزاد گذاشتن بقیه برای انطباق. پارامترهایی با امتیاز QFI پایین، با محدودیت‌های کمتری روبرو هستند. مدار انعطاف‌پذیری خود را حفظ کرده و درجات آزادی کم‌اهمیت‌تر خود را برای تطبیق با الگوهای ورودی جدید بازسازی می‌کند.

  • ایجاد تعادل بین پایداری و پلاستیسیته. این چارچوب به طور صریح بین حفظ دانش قدیمی و جذب اطلاعات جدید تعادل برقرار می‌کند. این روش نه کل مدار را منجمد می‌کند و نه اجازه می‌دهد همه چیز از مسیر خود منحرف شود.

این تعادل از آن جهت اهمیت دارد که یک مدار کاملاً منجمد نمی‌تواند چیز جدیدی بیاموزد، در حالی که یک مدار کاملاً انعطاف‌پذیر، هر آنچه را که قبلاً آموخته، فراموش می‌کند. QEWC با احترام به هندسه خودِ حالت کوانتومی، راه میانه را می‌یابد.

مقاومت در برابر نویز در سخت‌افزار واقعی

اکثر کامپیوترهای کوانتومی که در حال حاضر در دسترس هستند، دستگاه‌های کوانتومی در مقیاس متوسط نویزی یا NISQ هستند. خطاهای گیت، واهمدوسی (decoherence) و تداخل (cross-talk) تراشه‌های واقعی را گرفتار کرده‌اند. در چنین محیطی، اگر روشی در برابر نقص‌های سخت‌افزاری فرو بپاشد، زیبایی نظری آن هیچ معنایی نخواهد داشت.

آزمایش‌ها نشان می‌دهند که QEWC دقیقاً زمانی که نویز وجود دارد، از رویکردهای تجمیع کلاسیک بهتر عمل می‌کند. این یک نکته حاشیه‌ای کوچک نیست؛ بلکه تفاوت بین روشی است که روی کاغذ کار می‌کند و روشی که در مواجهه با یک ماشین فیزیکی دوام می‌آورد. استراتژی‌های کلاسیکِ وابسته به اندازه‌گیری، باید با همان کانال‌های نویزی دست‌وپنجه نرم کنند که خوانش‌های آن‌ها را دچار اعوجاج می‌کنند. از آنجایی که QEWC وزن‌های اهمیت خود را به جای آمار اندازه‌گیری نویزی، از هندسه حالت استخراج می‌کند، از بخشی از این آلودگی دوری می‌جوید. نتیجه، یک لایه حفظ‌کننده حافظه است که حتی زمانی که کیوبیت‌های اطراف آن دچار اختلال می‌شوند، پایدار می‌ماند.

شواهدی از شبیه‌سازی

برای اعتبارسنجی این چارچوب، تیم تحقیقاتی شبیه‌سازی‌هایی را روی بنچمارک‌های استاندارد یادگیری مداوم انجام داد. از مدل خواسته شد تا وظایفی مانند تشخیص اعداد دست‌نویس و دسته‌بندی تصاویر لباس را بیاموزد؛ چیدمانی که مشابه تقسیم‌بندی‌های کلاسیک MNIST و Fashion-MNIST مورد استفاده در این حوزه است. پس از آموزش روی وظیفه اول، مدار تحت شرایط استاندارد و سپس تحت حفاظت QEWC به سراغ وظیفه دوم رفت.

زمانی که آموزش استاندارد بر فرآیند حاکم بود، وظایف بعدی عملکرد مراحل قبلی را از بین بردند. مدار دچار «فراموشی فاجعه‌بار» (catastrophic forgetting) شدیدی شد. اما تحت پروتکل QEWC، داستان تغییر کرد. پارامترهای محافظت‌شده هندسه تشخیص اعداد خود را حفظ کردند، در حالی که پارامترهای آزاد با آستین، کفش و شلوار سازگار شدند. شکاف بین این دو رویکرد قابل توجه بود. QEWC در مقایسه با پروتکل‌های آموزشی معمولی، کاهش چشمگیری در از دست رفتن حافظه ایجاد کرد.

چرا یادگیری مداوم بازی را تغییر می‌دهد

سود بلندمدت در اینجا، یادگیری مداوم بدون نیاز به شروع مجدد است. در حال حاضر، بسیاری از خط لوله‌های آموزشی کوانتومی وقتی توزیع وظایف تغییر می‌کند، عملاً از صفر شروع می‌کنند. این رویکرد باعث هدر رفتن انرژی، زمان و بودجه محدود همدوسی (coherence) در سخت‌افزار کوانتومی می‌شود. اگر یک سیستم کوانتومی بتواند دانش را همان‌طور که یک مهندس انسانی مهارت‌ها را انباشته می‌کند، جمع‌آوری کند — یعنی حوزه‌های جدید را بدون پاک کردن حوزه‌های قدیمی اضافه کند — کاربرد عملی یادگیری ماشین کوانتومی به طرز چشمگیری گسترش می‌یابد.

دسترسی به کامپیوترهای کوانتومی گران است و کار با آن‌ها حساسیت زیادی می‌طلبد. آموزش مجدد از صفر برای هر مجموعه داده جدید، تجملاتی است که هیچ استقرار تجاری نمی‌تواند از پس آن برآید. QEWC به سمتی اشاره دارد که در آن یک مدل کوانتومی تکامل می‌یابد و آموزش‌های خود را به جلو می‌برد، به جای اینکه با هر وظیفه جدید، دوران پیش‌دبستانی را تکرار کند.

آنچه باید زیر نظر داشت

این تحقیق هنوز ریشه در شبیه‌سازی دارد، به این معنی که آزمون واقعی زمانی خواهد بود که QEWC به سخت‌افزارهای واقعی ابررسانا، یون‌های به دام افتاده یا فوتونیک منتقل شود. با این حال، تغییر مفهومی آن عمیق و کاربردی است. این اثر با پیوند دادن درک هندسی از حالت‌های کوانتومی به نیازهای عملی یادگیری ماشین، نشان می‌دهد که هوش مصنوعی کوانتومی می‌تواند بر یکی از اساسی‌ترین نقاط ضعف خود غلبه کند.

فراموشی فاجعه‌بار، هزینه‌ای اجتناب‌ناپذیر برای یادگیری نیست. QEWC نشان می‌دهد که یک داربست ریاضی مناسب — که به جای اندازه‌گیری‌های خشن، از اطلاعات فیشر کوانتومی (Quantum Fisher Information) ساخته شده است — می‌تواند حافظه یک مدل کوانتومی را در حالی که توجه آن به جای دیگری معطوف شده، دست‌نخورده نگه دارد.

برای کسانی که تقاطع محاسبات کوانتومی و هوش مصنوعی را دنبال می‌کنند، این موضوعی است که ارزش دنبال کردن دارد. در بحث‌ها شرکت کنید و از تحقیقات نوظهور در انجمن هوش مصنوعی GyaanSetu در https://t.me/GyaanSetuAi مطلع شوید.