تصور کنید در حال آموزش یک شبکه عصبی کوانتومی برای تشخیص اعداد دستنویس هستید. شما پارامترهای مدار را تا زمانی که دقت ثابت شود، تنظیم میکنید. سپس وظیفه دوم را ارائه میدهید: طبقهبندی تصاویر لباس. مدل به سرعت خود را تطبیق میدهد. اما وقتی دوباره آن را روی اعداد آزمایش میکنید، عملکرد مدل فرو میپاشد. مدار بر آنچه آموخته بود بنا ننهاد، بلکه آن را جایگزین کرد.
این پدیده «فراموشی فاجعهبار» (catastrophic forgetting) نام دارد و در زمره سرسختترین مشکلات در یادگیری ماشین قرار میگیرد. مدلهای کلاسیک مدام با آن دستوپنجه نرم میکنند. مدلهای کوانتومی با نسخه حتی شدیدتری از همین معضل روبرو هستند، زیرا سازوکارهای درونی آنها بر سوپرپوزیشن (superposition) و درهمتنیدگی (entanglement) متکی است که به محض مشاهده مستقیم، از بین میروند. یک رویکرد جدید و نویدبخش به نام تثبیت وزن الاستیک کوانتومی یا QEWC، با برخورد با حالت کوانتومی به عنوان یک شیء هندسی (به جای مجموعهای از نتایج اندازهگیری کلاسیک)، این مشکل را حل میکند.
چرا فراموشی در مدارهای کوانتومی شدیدتر است
در هر سیستم قابل آموزشی، یادگیری از طریق تنظیم پارامترها برای کاهش خطا رخ میدهد. خطر اینجاست که پارامترهای بهینه دیروز، همان متغیرهای امروز هستند. وقتی یک مدل آنها را برای تطبیق با وظیفهای جدید بازنویسی میکند، اغلب پیکربندیهای خاصی را که دانش قبلی را کدگذاری کرده بودند، پاک میکند. نتیجه، سیستمی است که به نظر میرسد به طور مداوم در حال یادگیری است، اما در واقع در حال چرخیدن میان تصاویر منزوی و گذرا از توانمندی است.
یادگیری ماشین کوانتومی این مسئله را تشدید میکند. رویکردهای کلاسیک برای حفظ حافظه معمولاً به مشاهده نحوه واکنش مدل به اندازهگیری بستگی دارند. آنها در اصل میپرسند: «اگر به این بخش از شبکه سقلمه بزنیم و خروجی را مشاهده کنیم، چقدر تغییر میکند؟» این منطق فرض را بر این میگذارد که میتوانید سیستم را بدون ایجاد اختلال اساسی مشاهده کنید. اما مکانیک کوانتومی چنین تضمینی نمیدهد. اندازهگیری باعث فروپاشی سوپرپوزیشن میشود. عملِ بررسی اینکه کدام پارامترها بیشترین اهمیت را دارند، میتواند دقیقاً همان حالتی را که سعی در محافظت از آن دارید، تغییر دهد.
آنچه حفاظهای حافظه کلاسیک نادیده میگیرند
هوش مصنوعی سنتی از دادههای مهم با متصل کردن آنها به آمارهای وابسته به اندازهگیری محافظت میکند. این روشهای کلاسیک، اهمیت پارامترها را از دریچه نحوه رفتار سیستم تحت خوانشهای (readouts) خاص دنبال میکنند. این روشها زمانی که سختافزار زیرساختی از قوانین کلاسیک پیروی میکند، به اندازه کافی خوب عمل میکنند؛ اما پردازندههای کوانتومی اینگونه نیستند.
یک مدار کوانتومی، اطلاعات را در یک بردار حالت با ابعاد بالا کدگذاری میکند که هندسه آن از دید مستقیم پنهان است. تکیه بر اندازهگیری تصویر (projective measurement) برای محافظت از آن اطلاعات، مانند تلاش برای حفظ شکل یک حباب صابون با سقلمه زدن به آن است. شما مقداری داده به دست میآورید، اما حباب از قبل تغییر کرده است. آنچه محققان به آن نیاز داشتند، راهی برای حس کردن اهمیت بدون نگاه مستقیم به خروجی در هر بار بود.
رویکرد اطلاعات فیشر کوانتومی
اینجاست که اطلاعات فیشر کوانتومی (QFI) وارد میدان میشود. QFI ابزاری برگرفته از مترولوژی کوانتومی است که میزان حساسیت یک حالت کوانتومی را نسبت به تغییرات کوچک در پارامترهای زیربنایی آن اندازهگیری میکند. به جای اینکه بپرسد یک اندازهگیری چه چیزی را نشان میدهد، QFI میپرسد که هندسه خودِ حالت چگونه حول هر پارامتر خم میشود. مشخص شده است پارامترهایی که در نواحی تندِ فضای حالت قرار دارند — جایی که یک تکان کوچک باعث یک تغییر هندسی بزرگ میشود — همانهایی هستند که بیشترین دانش حیاتی مربوط به وظیفه را حمل میکنند.
با استفاده از QFI، محققان میتوانند اهمیت را مستقیماً بر هندسه حالت کوانتومی نگاشت کنند. این روش برای تثبیت آنچه مهم است، به هیچ پایه اندازهگیری خاصی نیاز ندارد. این روش به حالت به عنوان یک سطح نگاه میکند و تپههایی را که نباید صاف شوند، شناسایی میکند.
چگونه QEWC از دانش محافظت میکند
تثبیت وزن الاستیک کوانتومی (QEWC) آن بینش هندسی را به یک پروتکل آموزشی تبدیل میکند. این فرآیند را میتوان به مراحل ملموس زیر تقسیم کرد:
شناسایی پارامترهای حیاتی. پس از یادگیری اولین وظیفه، QEWC اطلاعات فیشر کوانتومی را در سراسر پارامترهای مدار محاسبه میکند. امتیازهای بالا، چرخشها و درهمتنیدگیهای خاصی را که دانش حیاتی را ذخیره میکنند، علامتگذاری میکنند.
قفل کردن بخشهای مهم. در طول آموزشهای بعدی، QEWC جریمهای را برای تغییر در آن پارامترهای با QFI بالا اعمال میکند. مدار برای بازنویسی آنچه از قبل میداند، هزینه پرداخت میکند.
آزاد گذاشتن بقیه برای انطباق. پارامترهایی با امتیاز QFI پایین، با محدودیتهای کمتری روبرو هستند. مدار انعطافپذیری خود را حفظ کرده و درجات آزادی کماهمیتتر خود را برای تطبیق با الگوهای ورودی جدید بازسازی میکند.
ایجاد تعادل بین پایداری و پلاستیسیته. این چارچوب به طور صریح بین حفظ دانش قدیمی و جذب اطلاعات جدید تعادل برقرار میکند. این روش نه کل مدار را منجمد میکند و نه اجازه میدهد همه چیز از مسیر خود منحرف شود.
این تعادل از آن جهت اهمیت دارد که یک مدار کاملاً منجمد نمیتواند چیز جدیدی بیاموزد، در حالی که یک مدار کاملاً انعطافپذیر، هر آنچه را که قبلاً آموخته، فراموش میکند. QEWC با احترام به هندسه خودِ حالت کوانتومی، راه میانه را مییابد.
مقاومت در برابر نویز در سختافزار واقعی
اکثر کامپیوترهای کوانتومی که در حال حاضر در دسترس هستند، دستگاههای کوانتومی در مقیاس متوسط نویزی یا NISQ هستند. خطاهای گیت، واهمدوسی (decoherence) و تداخل (cross-talk) تراشههای واقعی را گرفتار کردهاند. در چنین محیطی، اگر روشی در برابر نقصهای سختافزاری فرو بپاشد، زیبایی نظری آن هیچ معنایی نخواهد داشت.
آزمایشها نشان میدهند که QEWC دقیقاً زمانی که نویز وجود دارد، از رویکردهای تجمیع کلاسیک بهتر عمل میکند. این یک نکته حاشیهای کوچک نیست؛ بلکه تفاوت بین روشی است که روی کاغذ کار میکند و روشی که در مواجهه با یک ماشین فیزیکی دوام میآورد. استراتژیهای کلاسیکِ وابسته به اندازهگیری، باید با همان کانالهای نویزی دستوپنجه نرم کنند که خوانشهای آنها را دچار اعوجاج میکنند. از آنجایی که QEWC وزنهای اهمیت خود را به جای آمار اندازهگیری نویزی، از هندسه حالت استخراج میکند، از بخشی از این آلودگی دوری میجوید. نتیجه، یک لایه حفظکننده حافظه است که حتی زمانی که کیوبیتهای اطراف آن دچار اختلال میشوند، پایدار میماند.
شواهدی از شبیهسازی
برای اعتبارسنجی این چارچوب، تیم تحقیقاتی شبیهسازیهایی را روی بنچمارکهای استاندارد یادگیری مداوم انجام داد. از مدل خواسته شد تا وظایفی مانند تشخیص اعداد دستنویس و دستهبندی تصاویر لباس را بیاموزد؛ چیدمانی که مشابه تقسیمبندیهای کلاسیک MNIST و Fashion-MNIST مورد استفاده در این حوزه است. پس از آموزش روی وظیفه اول، مدار تحت شرایط استاندارد و سپس تحت حفاظت QEWC به سراغ وظیفه دوم رفت.
زمانی که آموزش استاندارد بر فرآیند حاکم بود، وظایف بعدی عملکرد مراحل قبلی را از بین بردند. مدار دچار «فراموشی فاجعهبار» (catastrophic forgetting) شدیدی شد. اما تحت پروتکل QEWC، داستان تغییر کرد. پارامترهای محافظتشده هندسه تشخیص اعداد خود را حفظ کردند، در حالی که پارامترهای آزاد با آستین، کفش و شلوار سازگار شدند. شکاف بین این دو رویکرد قابل توجه بود. QEWC در مقایسه با پروتکلهای آموزشی معمولی، کاهش چشمگیری در از دست رفتن حافظه ایجاد کرد.
چرا یادگیری مداوم بازی را تغییر میدهد
سود بلندمدت در اینجا، یادگیری مداوم بدون نیاز به شروع مجدد است. در حال حاضر، بسیاری از خط لولههای آموزشی کوانتومی وقتی توزیع وظایف تغییر میکند، عملاً از صفر شروع میکنند. این رویکرد باعث هدر رفتن انرژی، زمان و بودجه محدود همدوسی (coherence) در سختافزار کوانتومی میشود. اگر یک سیستم کوانتومی بتواند دانش را همانطور که یک مهندس انسانی مهارتها را انباشته میکند، جمعآوری کند — یعنی حوزههای جدید را بدون پاک کردن حوزههای قدیمی اضافه کند — کاربرد عملی یادگیری ماشین کوانتومی به طرز چشمگیری گسترش مییابد.
دسترسی به کامپیوترهای کوانتومی گران است و کار با آنها حساسیت زیادی میطلبد. آموزش مجدد از صفر برای هر مجموعه داده جدید، تجملاتی است که هیچ استقرار تجاری نمیتواند از پس آن برآید. QEWC به سمتی اشاره دارد که در آن یک مدل کوانتومی تکامل مییابد و آموزشهای خود را به جلو میبرد، به جای اینکه با هر وظیفه جدید، دوران پیشدبستانی را تکرار کند.
آنچه باید زیر نظر داشت
این تحقیق هنوز ریشه در شبیهسازی دارد، به این معنی که آزمون واقعی زمانی خواهد بود که QEWC به سختافزارهای واقعی ابررسانا، یونهای به دام افتاده یا فوتونیک منتقل شود. با این حال، تغییر مفهومی آن عمیق و کاربردی است. این اثر با پیوند دادن درک هندسی از حالتهای کوانتومی به نیازهای عملی یادگیری ماشین، نشان میدهد که هوش مصنوعی کوانتومی میتواند بر یکی از اساسیترین نقاط ضعف خود غلبه کند.
فراموشی فاجعهبار، هزینهای اجتنابناپذیر برای یادگیری نیست. QEWC نشان میدهد که یک داربست ریاضی مناسب — که به جای اندازهگیریهای خشن، از اطلاعات فیشر کوانتومی (Quantum Fisher Information) ساخته شده است — میتواند حافظه یک مدل کوانتومی را در حالی که توجه آن به جای دیگری معطوف شده، دستنخورده نگه دارد.
برای کسانی که تقاطع محاسبات کوانتومی و هوش مصنوعی را دنبال میکنند، این موضوعی است که ارزش دنبال کردن دارد. در بحثها شرکت کنید و از تحقیقات نوظهور در انجمن هوش مصنوعی GyaanSetu در https://t.me/GyaanSetuAi مطلع شوید.
