การตรวจพบการนำไปใช้ในทางที่ผิด

ระบบตรวจสอบภายในของ Anthropic ได้ตรวจพบชุดคำสั่งแบบ "dual-use" (การใช้งานแบบสองทาง) ซึ่งเป็นคำขอที่อาจสนับสนุนการวิจัยที่ถูกกฎหมาย แต่ในขณะเดียวกันก็อาจนำไปสู่การใช้งานที่เป็นอันตรายได้ นักวิจัยคนหนึ่งได้ขอให้ Claude ออกแบบการกลายพันธุ์ที่จะทำให้ไวรัสชิกุนกุนยา (Chikungunya) สามารถแพร่กระจายได้ง่ายขึ้น การใช้ถ้อยคำในคำขอและการทดสอบซ้ำๆ กับสัตว์ที่มีชีวิตบ่งชี้ถึงบริบทของการวิจัยทางการทหาร ไม่ใช่ความพยายามด้านสาธารณสุข เพื่อปกปิดเจตนาที่แท้จริง ผู้ใช้ได้ใช้การใช้คำที่หลอกล่อ ซึ่งกระตุ้นให้ Anthropic ต้องเพิ่มความเข้มงวดของมาตรการป้องกันทางชีวภาพในโมเดลรุ่นใหม่ๆ ที่มีความสามารถสูงขึ้น

การสืบสวนที่ดำเนินไปพร้อมกันยังได้เปิดเผยความพยายามในการสร้างแผนผังและซอร์สโค้ดสำหรับอาวุธปืน ระบบนำวิถีขีปนาวุธ โดรนติดอาวุธ และส่วนประกอบของระเบิด โดยพบคำขอ 6 รายการที่สืบย้อนไปยังที่อยู่ IP ในประเทศจีน รัสเซีย และเยเมน ซึ่งกิจกรรมในเยเมนดูเหมือนจะเชื่อมโยงกับกลุ่มฮูตีที่ได้รับการสนับสนุนจากอิหร่าน ในอีกด้านหนึ่ง Anthropic ได้ระบุถึงแคมเปญข้อมูลบิดเบือนที่ขับเคลื่อนด้วย AI โดยตัวแสดงจากรัฐบาลจีนและอิหร่านได้ใช้ Claude ในการเฝ้าติดตามชุมชนผู้พลัดถิ่น ในขณะที่สื่อของรัฐรัสเซียได้ใช้โมเดลนี้เพื่อผลิตบทความ "อิสระ" ที่แพร่กระจายข้อมูลเท็จเกี่ยวกับการเลือกตั้งในมอลโดวา

ทำไมรายงานฉบับนี้จึงมีความสำคัญ

การเปิดเผยข้อมูลนี้เกิดขึ้นในช่วงที่โมเดล AI กำลังวิวัฒนาการจากแชทบอทไปสู่เครื่องมือที่สามารถใช้เหตุผลทางวิทยาศาสตร์ได้ สำหรับรัฐบาลต่างๆ ความเสี่ยงนั้นมีสองด้าน ประการแรก การเข้าถึง AI ขั้นสูงได้ง่ายขึ้นช่วยลดอุปสรรคสำหรับตัวแสดงของรัฐหรือที่ไม่ใช่รัฐในการเริ่มโครงการอาวุธที่ผิดกฎหมาย ประการที่สอง โมเดลเดียวกันนี้สามารถกลายเป็นพาหะของสงครามข้อมูลข่าวสาร โดยช่วยให้การโฆษณาชวนเชื่อที่มีความซับซ้อนทำได้ง่ายขึ้นและยากต่อการสืบหาต้นตอ รายงานฉบับนี้จึงเป็นการเพิ่มแรงกดดันต่อผู้กำหนดนโยบายให้ปฏิบัติต่อ AI ในฐานะเทคโนโลยีที่ใช้ได้สองทาง (dual-use technology) ซึ่งต้องอยู่ภายใต้การควบคุมการส่งออก กฎระเบียบด้านความปลอดภัยทางชีวภาพ และกลยุทธ์การป้องกันทางไซเบอร์

การตอบสนองของ Anthropic และความตึงเครียดภายใน

เพื่อเป็นการตอบโต้ Anthropic ได้เริ่มใช้มาตรการป้องกันที่เข้มงวดขึ้นในตระกูลโมเดลล่าสุด โดยสั่งห้ามคำขอที่ร้องขอการดัดแปลงเชื้อก่อโรคหรือการออกแบบอาวุธอย่างชัดเจน

รายงานนี้ปรากฏขึ้นท่ามกลางความขัดแย้งภายใน โดย Jacob Coxon นักวิจัยได้ลาออกเมื่อต้นปีนี้ พร้อมเตือนว่าการเร่งผลักดันระบบที่มีประสิทธิภาพสูงขึ้นของอุตสาหกรรมนั้นรวดเร็วกว่าการพัฒนาตาข่ายความปลอดภัย การลาออกของเขาตอกย้ำถึงการถกเถียงในวงกว้างที่ว่า บริษัท AI เอกชนกำลังทำหน้าที่เป็น "ตำรวจดิจิทัล" โดยพฤตินัย ซึ่งเป็นผู้ตัดสินว่าอะไรคือภัยคุกคามด้านความมั่นคงโดยไม่มีกรอบการทำงานของรัฐบาลที่ชัดเจน นักวิจารณ์โต้แย้งว่าการกำกับดูแลตนเองไม่สามารถก้าวทันความฉลาดหลักแหลมของฝ่ายตรงข้ามได้ ในขณะที่ฝ่ายสนับสนุนชี้ให้เห็นว่าการเปลี่ยนแปลงนโยบายที่รวดเร็วของ Anthropic เป็นข้อพิสูจน์ว่าอุตสาหกรรมสามารถปรับตัวได้อย่างรวดเร็ว

สิ่งที่การค้นพบเหล่านี้บ่งชี้สำหรับอินเดีย

  • ความระแวดระวังด้านความปลอดภัยทางชีวภาพ – ภาคส่วนเทคโนโลยีชีวภาพที่กำลังเติบโตของอินเดียจะพึ่งพา AI มากขึ้นในการค้นหายาและการวิเคราะห์เชื้อก่อโรค การนำการตรวจสอบที่ขับเคลื่อนด้วย AI เข้าไปรวมไว้ในระเบียบปฏิบัติความปลอดภัยทางชีวภาพที่มีอยู่ อาจช่วยตรวจพบความพยายามในการใช้เครื่องมือภายในประเทศเพื่อการวิจัยแบบ dual-use ได้
  • การปกป้องวาทกรรมประชาธิปไตย – การใช้ Claude เพื่อเฝ้าติดตามกลุ่มผู้พลัดถิ่นและการแพร่กระจายข้อมูลเท็จที่เกี่ยวข้องกับการเลือกตั้ง ส่งสัญญาณถึงความจำเป็นในการมีมาตรการป้องกันทางไซเบอร์ที่เข้มแข็งขึ้น และแคมเปญสร้างความตระหนักรู้แก่สาธารณะที่สามารถตรวจจับข้อมูลบิดเบือนที่สร้างโดย AI ได้
  • การสร้างขีดความสามารถด้าน AI ของตนเอง – การพึ่งพาโมเดลที่มีฐานอยู่ในสหรัฐฯ สำหรับงานทางวิทยาศาสตร์ที่มีความสำคัญสูง ชี้ให้เห็นถึงช่องว่างทางยุทธศาสตร์ การพัฒนาโมเดลที่สร้างขึ้นเองซึ่งมีการฝังมาตรฐานความปลอดภัยและแนวทางจริยธรรมของอินเดีย อาจช่วยลดความเสี่ยงจากการแทรกแซงของต่างชาติและควบคุมการไหลเวียนของขีดความสามารถด้าน AI ที่ละเอียดอ่อนได้

มุมมองโต้แย้ง: ข้อสนับสนุนการกำกับดูแลตนเอง

การเปิดตัวฟิลเตอร์ใหม่ที่รวดเร็วของ Anthropic แสดงให้เห็นว่าบริษัทเอกชนสามารถดำเนินการได้เร็วกว่าฝ่ายนิติบัญญัติหลายแห่ง บริษัทโต้แย้งว่านโยบาย "การใช้งานอย่างรับผิดชอบ" (responsible-use) เมื่อรวมกับการทดสอบแบบ red-team ที่ดำเนินการอย่างต่อเนื่อง จะเป็นมาตรการแก้ปัญหาเฉพาะหน้าที่ใช้งานได้จริงในขณะที่รัฐบาลกำลังถกเถียงกันเรื่องกฎระเบียบที่เป็นทางการ ฝ่ายสนับสนุนตั้งข้อสังเกตว่ากฎหมายที่กำหนดรายละเอียดมากเกินไปอาจขัดขวางนวัตกรรม โดยเฉพาะในสาขาที่ AI ช่วยเร่งการค้นพบทางการแพทย์ ความท้าทายคือการสร้างสมดุลที่มาตรการป้องกันของอุตสาหกรรมมีความโปร่งใสและสามารถตรวจสอบได้ โดยไม่ขัดขวางการใช้งานที่เป็นประโยชน์ตามที่ AI สัญญาไว้

สิ่งที่ต้องจับตามองต่อไป

  • การเคลื่อนไหวทางด้านกฎระเบียบ – คาดว่าจะมีการตรวจสอบที่เข้มงวดขึ้นจากหน่วยงานควบคุมการส่งออกและหน่วยงานกำกับดูแลความปลอดภัยทางชีวภาพ ซึ่งอาจนำไปสู่แนวทางปฏิบัติใหม่ๆ ที่กำหนดให้โมเดลเจเนอเรทีฟขั้นสูงเป็นเทคโนโลยีที่ต้องมีการควบคุม
  • ความร่วมมือในอุตสาหกรรม – Anthropic อาจเข้าร่วมหรือขยายพันธมิตรด้านความปลอดภัยของ AI ที่มีอยู่เดิมเพื่อแบ่งปันข้อมูลข่าวกรองด้านภัยคุกคาม ซึ่งเป็นขั้นตอนที่อาจช่วยสร้างมาตรฐานในการรายงานความพยายามในการนำเทคโนโลยีไปใช้ในสองทาง (dual-use) ทั่วทั้งภาคส่วน
  • การตอบสนองจากภาครัฐ – ประเทศต่างๆ ที่ระบุไว้ในรายงานมีแนวโน้มที่จะปฏิเสธความเกี่ยวข้อง และอาจเร่งโครงการพัฒนา AI ของตนเอง ซึ่งจะสร้างวงจรป้อนกลับที่อาจทำให้เส้นแบ่งระหว่างการใช้ AI เพื่อการป้องกันและการโจมตีเลือนลางลงไปอีก

รายงานของ Anthropic แสดงให้เห็นว่า พลังในการสร้างสรรค์ (generative power) แบบเดียวกันที่ช่วยให้นักวิทยาศาสตร์จำลองโครงสร้างโปรตีนได้ ก็สามารถถูกนำไปใช้เป็นอาวุธได้เช่นกัน และความปลอดภัยของ AI ในขณะนี้ได้กลายเป็นประเด็นสำคัญในด้านภูมิรัฐศาสตร์อย่างเต็มตัว ในช่วงไม่กี่เดือนข้างหน้าจะเป็นบททดสอบว่า การกำกับดูแลตนเอง นโยบายของรัฐบาล หรือแนวทางแบบผสมผสาน จะสามารถป้องกันไม่ให้เทคโนโลยีนี้กลายเป็นเครื่องมือของความขัดแย้งได้หรือไม่