ลองจินตนาการว่าคุณกำลังฝึกโครงข่ายประสาทเทียมควอนตัม (quantum neural network) ให้จดจำตัวเลขที่เขียนด้วยมือ คุณปรับจูนพารามิเตอร์ของวงจรจนกระทั่งความแม่นยำเริ่มคงที่ จากนั้นคุณจึงมอบหมายงานที่สอง: การจำแนกรูปภาพเสื้อผ้า โมเดลสามารถปรับตัวได้อย่างรวดเร็ว แต่เมื่อคุณนำมันกลับไปทดสอบกับตัวเลขอีกครั้ง ประสิทธิภาพกลับพังทลายลง วงจรไม่ได้ต่อยอดจากสิ่งที่มันเคยเรียนรู้ แต่มันกลับแทนที่มันไปเสียเลย

นี่คือ catastrophic forgetting (การลืมแบบหายนะ) และมันจัดว่าเป็นหนึ่งในปัญหาที่แก้ได้ยากที่สุดในด้านการเรียนรู้ของเครื่อง (machine learning) โมเดลแบบคลาสสิกต้องเผชิญกับปัญหานี้อยู่ตลอดเวลา ส่วนโมเดลควอนตัมต้องเผชิญกับปัญหาในรูปแบบที่รุนแรงยิ่งกว่า เพราะการทำงานภายในของมันอาศัยการซ้อนทับ (superposition) และความพัวพัน (entanglement) ซึ่งจะถูกทำลายลงทันทีที่คุณทำการสังเกตโดยตรง แนวทางใหม่ที่น่าสนใจอย่าง Quantum Elastic Weight Consolidation หรือ QEWC แก้ปัญหานี้โดยการปฏิบัติต่อสถานะควอนตัมในฐานะวัตถุทางเรขาคณิต แทนที่จะมองว่าเป็นเพียงชุดของผลลัพธ์การวัดแบบคลาสสิก

ทำไมการลืมจึงส่งผลกระทบรุนแรงกว่าในวงจรควอนตัม

ในระบบที่สามารถฝึกฝนได้ใดๆ การเรียนรู้เกิดขึ้นจากการปรับพารามิเตอร์เพื่อลดข้อผิดพลาด ความเสี่ยงก็คือ พารามิเตอร์ที่เหมาะสมที่สุดของเมื่อวาน อาจกลายเป็นตัวแปรของวันนี้ เมื่อโมเดลเขียนพารามิเตอร์เหล่านั้นใหม่เพื่อให้เข้ากับงานใหม่ มันมักจะลบการกำหนดค่าเฉพาะที่เคยเข้ารหัสความรู้ก่อนหน้าไว้ ผลลัพธ์ที่ได้คือระบบที่ดูเหมือนจะเรียนรู้อย่างต่อเนื่อง แต่ในความเป็นจริงกลับเป็นการวนลูปผ่านช่วงเวลาสั้นๆ ของความสามารถที่แยกขาดจากกัน

การเรียนรู้ของเครื่องเชิงควอนตัม (Quantum machine learning) ยิ่งทำให้ปัญหานี้ซับซ้อนขึ้น แนวทางแบบคลาสสิกในการรักษาความจำมักจะขึ้นอยู่กับการเฝ้าดูว่าโมเดลตอบสนองต่อการวัดอย่างไร โดยพื้นฐานแล้วพวกมันจะถามว่า "ถ้าเราไปสะกิดส่วนนี้ของโครงข่ายและดูผลลัพธ์ มันจะเปลี่ยนแปลงไปมากแค่ไหน?" ตรรกะนั้นตั้งอยู่บนสมมติฐานที่คุณสามารถสังเกตระบบได้โดยไม่ไปรบกวนมันอย่างมีนัยสำคัญ แต่กลศาสตร์ควอนตัมไม่มีการรับประกันเช่นนั้น การวัดจะทำให้การซ้อนทับพังทลายลง การกระทำเพื่อตรวจสอบว่าพารามิเตอร์ใดสำคัญที่สุดอาจไปเปลี่ยนแปลงสถานะที่คุณกำลังพยายามปกป้องอยู่เสียเอง

สิ่งที่กลไกป้องกันความจำแบบคลาสสิกมองข้าม

AI แบบดั้งเดิมปกป้องข้อมูลสำคัญโดยการยึดโยงไว้กับสถิติที่ขึ้นอยู่กับการวัด วิธีการแบบคลาสสิกเหล่านี้จะติดตามความสำคัญของพารามิเตอร์ผ่านมุมมองของพฤติกรรมระบบภายใต้การอ่านค่าเฉพาะเจาะจง ซึ่งวิธีเหล่านี้ทำงานได้ดีพอสมควรเมื่อฮาร์ดแวร์พื้นฐานปฏิบัติตามกฎแบบคลาสสิก แต่โปรเซสเซอร์ควอนตัมไม่ได้เป็นเช่นนั้น

วงจรควอนตัมเข้ารหัสข้อมูลไว้ในเวกเตอร์สถานะ (state vector) มิติสูง ซึ่งเรขาคณิตของมันถูกซ่อนไว้จากการมองเห็นโดยตรง การพึ่งพาการวัดเชิงฉาย (projective measurement) เพื่อปกป้องข้อมูลนั้น เปรียบเสมือนการพยายามรักษาทรงของฟองสบู่ด้วยการเอานิ้วไปจิ้ม คุณอาจจะได้ข้อมูลมาบ้าง แต่ฟองสบู่ก็เปลี่ยนรูปไปแล้ว สิ่งที่นักวิจัยต้องการคือวิธีที่จะรับรู้ถึงความสำคัญโดยไม่ต้องจ้องมองไปที่ผลลัพธ์โดยตรงทุกครั้ง

แนวทาง Quantum Fisher Information

นั่นคือจุดที่ Quantum Fisher Information เข้ามามีบทบาท QFI เป็นเครื่องมือที่มาจากมาตรวิทยาควอนตัม (quantum metrology) ซึ่งใช้วัดความไวของสถานะควอนตัมต่อการเปลี่ยนแปลงเล็กน้อยในพารามิเตอร์พื้นฐาน แทนที่จะถามว่าการวัดแสดงผลอย่างไร QFI จะถามว่าเรขาคณิตของสถานะนั้นเองบิดโค้งไปรอบๆ แต่ละพารามิเตอร์อย่างไร พารามิเตอร์ที่อยู่ในบริเวณที่มีความชันสูงของปริภูมิสถานะ (state space)—ซึ่งการขยับเพียงเล็กน้อยจะทำให้เกิดการเปลี่ยนแปลงทางเรขาคณิตอย่างมาก—จะกลายเป็นพารามิเตอร์ที่ถือครองความรู้ที่สำคัญที่สุดต่องานนั้นๆ

การใช้ QFI ช่วยให้นักวิจัยสามารถทำแผนที่ความสำคัญลงบนเรขาคณิตของสถานะควอนตัมได้โดยตรง วิธีนี้ไม่จำเป็นต้องใช้ฐานการวัด (measurement basis) เฉพาะเจาะจงเพื่อล็อกสิ่งที่สำคัญ แต่มันมองสถานะเป็นพื้นผิวและระบุ "เนิน" (hills) ที่ต้องไม่ถูกทำให้ราบเรียบ

QEWC ปกป้องความรู้อย่างไร

Quantum Elastic Weight Consolidation เปลี่ยนความเข้าใจทางเรขาคณิตนั้นให้กลายเป็นโปรโตคอลการฝึกฝน โดยสามารถแบ่งออกเป็นขั้นตอนที่เป็นรูปธรรมได้ดังนี้:

  • ระบุพารามิเตอร์ที่สำคัญ: หลังจากเรียนรู้งานแรก QEWC จะคำนวณค่า Quantum Fisher Information ของพารามิเตอร์ต่างๆ ในวงจร คะแนนที่สูงจะระบุถึงการหมุน (rotations) และความพัวพัน (entanglements) เฉพาะเจาะจงที่เก็บรักษาความรู้ที่สำคัญไว้

  • ล็อกส่วนที่สำคัญ: ในระหว่างการฝึกฝนในขั้นตอนต่อมา QEWC จะใช้บทลงโทษ (penalty) ต่อการเปลี่ยนแปลงในพารามิเตอร์ที่มีค่า QFI สูง วงจรจะต้อง "จ่ายราคา" หากต้องการเขียนทับสิ่งที่มันรู้อยู่แล้ว

  • ปล่อยส่วนที่เหลือให้ปรับตัว: พารามิเตอร์ที่มีคะแนน QFI ต่ำจะถูกจำกัดน้อยกว่า วงจรจะยังคงความยืดหยุ่น โดยการปรับเปลี่ยนองศาอิสระ (degrees of freedom) ที่มีความสำคัญน้อยกว่าเพื่อให้เข้ากับรูปแบบข้อมูลใหม่

  • สร้างสมดุลระหว่างความเสถียรและความยืดหยุ่น: โครงสร้างนี้จะแลกเปลี่ยน (trade off) ระหว่างการรักษาความรู้เก่าและการรับข้อมูลใหม่ได้อย่างชัดเจน มันไม่ได้แช่แข็งวงจรทั้งหมด และไม่ได้ปล่อยให้ทุกอย่างไหลไปตามยถากรรม

ความสมดุลนี้มีความสำคัญ เพราะวงจรที่ถูกแช่แข็งโดยสมบูรณ์จะไม่สามารถเรียนรู้สิ่งใหม่ได้ ในขณะที่วงจรที่มีความยืดหยุ่นสูงเกินไปก็จะลืมทุกอย่างที่เคยเรียนรู้มา QEWC จึงหาจุดสมดุลโดยการให้ความสำคัญกับเรขาคณิต (geometry) ของสถานะควอนตัมโดยตรง

ความทนทานต่อสัญญาณรบกวนบนฮาร์ดแวร์จริง

คอมพิวเตอร์ควอนตัมส่วนใหญ่ที่มีอยู่ในปัจจุบันเป็นอุปกรณ์ประเภท Noisy Intermediate-Scale Quantum หรือ NISQ ซึ่งมักประสบปัญหาจากข้อผิดพลาดของเกต (gate errors), การสูญเสียความสอดคล้อง (decoherence) และสัญญาณรบกวนข้ามช่อง (cross-talk) ในสภาพแวดล้อมเช่นนี้ ความสวยงามทางทฤษฎีจะไม่มีความหมายเลยหากวิธีการนั้นล้มเหลวเมื่อต้องเผชิญกับความไม่สมบูรณ์ของฮาร์ดแวร์

ผลการทดสอบระบุว่า QEWC มีประสิทธิภาพเหนือกว่าวิธีการรวมข้อมูล (consolidation) แบบดั้งเดิม โดยเฉพาะอย่างยิ่งเมื่อมีสัญญาณรบกวนปรากฏอยู่ นี่ไม่ใช่เพียงประเด็นเล็กน้อย แต่มันคือความแตกต่างระหว่างวิธีการที่ใช้งานได้ดีแค่ในกระดาษ กับวิธีการที่สามารถใช้งานได้จริงกับเครื่องจักรทางกายภาพ กลยุทธ์แบบดั้งเดิมที่ต้องพึ่งพาการวัดค่า (measurement-dependent) จะต้องต่อสู้กับช่องสัญญาณรบกวนแบบเดียวกับที่บิดเบือนค่าที่อ่านได้ แต่เนื่องจาก QEWC คำนวณค่าน้ำหนักความสำคัญ (importance weights) จากเรขาคณิตของสถานะ แทนที่จะใช้สถิติจากการวัดที่มีสัญญาณรบกวน มันจึงสามารถหลีกเลี่ยงความเสียหายบางส่วนนั้นได้ ผลลัพธ์ที่ได้คือชั้นการรักษาความจำ (memory-preserving layer) ที่ยังคงความเสถียรแม้ว่าคิวบิต (qubits) รอบข้างจะทำงานผิดปกติก็ตาม

หลักฐานจากการจำลอง

เพื่อพิสูจน์ความถูกต้องของกรอบการทำงานนี้ ทีมวิจัยได้ทำการจำลองบนเกณฑ์มาตรฐานการเรียนรู้แบบต่อเนื่อง (continual learning benchmarks) โดยให้โมเดลเรียนรู้ภารกิจต่างๆ เช่น การจดจำตัวเลขเขียนด้วยมือและการจำแนกประเภทรูปภาพเสื้อผ้า ซึ่งเป็นการตั้งค่าที่เลียนแบบชุดข้อมูล MNIST และ Fashion-MNIST ที่ใช้กันอย่างแพร่หลายในสาขานี้ หลังจากฝึกฝนในภารกิจแรกแล้ว วงจรจะเข้าสู่ภารกิจที่สองภายใต้เงื่อนไขมาตรฐาน และอีกครั้งภายใต้การป้องกันของ QEWC

เมื่อใช้การฝึกฝนแบบมาตรฐาน ภารกิจในภายหลังจะทำลายประสิทธิภาพของภารกิจก่อนหน้า โดยวงจรจะแสดงอาการการลืมอย่างรุนแรง (catastrophic forgetting) อย่างชัดเจน แต่ภายใต้ QEWC ผลลัพธ์กลับเปลี่ยนไป พารามิเตอร์ที่ได้รับการป้องกันจะยังคงรักษาเรขาคณิตในการจดจำตัวเลขไว้ ในขณะที่พารามิเตอร์อิสระจะปรับตัวเข้ากับรูปภาพแขนเสื้อ รองเท้า และกางเกงแทน ช่องว่างระหว่างทั้งสองแนวทางนี้มีความแตกต่างกันอย่างมีนัยสำคัญ โดย QEWC สามารถลดการสูญเสียความจำได้อย่างชัดเจนเมื่อเทียบกับโปรโตคอลการฝึกฝนแบบปกติ

ทำไมการเรียนรู้แบบต่อเนื่องจึงเปลี่ยนเกม

ผลตอบแทนในระยะยาวคือการเรียนรู้แบบต่อเนื่องโดยไม่ต้องเริ่มใหม่ทั้งหมด ในปัจจุบัน กระบวนการฝึกฝนควอนตัม (quantum training pipelines) จำนวนมากต้องเริ่มจากศูนย์ใหม่ทุกครั้งเมื่อการกระจายตัวของภารกิจเปลี่ยนไป แนวทางดังกล่าวทำให้เสียทั้งพลังงาน เวลา และงบประมาณด้านความสอดคล้อง (coherence budget) ที่มีจำกัดของฮาร์ดแวร์ควอนตัม หากระบบควอนตัมสามารถสะสมความรู้ได้เหมือนกับที่วิศวกรที่เป็นมนุษย์สะสมทักษะ—นั่นคือการเพิ่มความรู้ในโดเมนใหม่โดยไม่ลบความรู้เดิม—ประโยชน์ในเชิงปฏิบัติของ Quantum Machine Learning จะขยายตัวขึ้นอย่างมหาศาล

คอมพิวเตอร์ควอนตัมมีค่าใช้จ่ายในการเข้าถึงสูงและใช้งานยาก การต้องฝึกฝนใหม่ตั้งแต่ศูนย์สำหรับทุกชุดข้อมูลใหม่ถือเป็นความฟุ่มเฟือยที่การใช้งานในเชิงพาณิชย์ไม่สามารถแบกรับได้ QEWC กำลังชี้ไปสู่ยุคที่โมเดลควอนตัมเพียงโมเดลเดียวสามารถวิวัฒนาการได้ โดยนำความรู้ที่มีอยู่พัฒนาต่อไป แทนที่จะต้องกลับไปเรียนระดับอนุบาลใหม่ทุกครั้งที่มีงานใหม่เข้ามา

สิ่งที่ต้องจับตามอง

งานวิจัยนี้ยังคงอิงอยู่กับการจำลอง ซึ่งหมายความว่าบททดสอบที่แท้จริงจะเกิดขึ้นเมื่อมีการนำ QEWC ไปใช้กับฮาร์ดแวร์จริง ไม่ว่าจะเป็นแบบ superconducting, trapped-ion หรือ photonic อย่างไรก็ตาม การเปลี่ยนแปลงทางแนวคิดนี้มีความชัดเจนและเป็นประโยชน์ การนำความเข้าใจเชิงเรขาคณิตของสถานะควอนตัมมาผสานเข้ากับความต้องการเชิงปฏิบัติของ Machine Learning แสดงให้เห็นว่า Quantum AI สามารถเอาชนะหนึ่งในข้อจำกัดพื้นฐานที่สุดของมันได้

การลืมอย่างรุนแรง (Catastrophic forgetting) ไม่ใช่ภาษีที่หลีกเลี่ยงไม่ได้ของการเรียนรู้ QEWC แสดงให้เห็นว่าโครงสร้างทางคณิตศาสตร์ที่เหมาะสม—ซึ่งสร้างขึ้นจาก Quantum Fisher Information แทนที่จะเป็นการวัดค่าแบบหักโหม (brute-force measurement)—สามารถรักษาความจำของโมเดลควอนตัมให้คงอยู่ได้ ในขณะที่ความสนใจของโมเดลกำลังมุ่งไปที่เรื่องอื่น

สำหรับผู้ที่ติดตามจุดตัดระหว่าง Quantum Computing และ Artificial Intelligence นี่คือประเด็นที่คุ้มค่าแก่การติดตาม ร่วมพูดคุยและอัปเดตงานวิจัยใหม่ๆ ได้ในชุมชน GyaanSetu AI ที่ https://t.me/GyaanSetuAi