1 ส.ค. เวลา 08:00 • ไอที & แก็ดเจ็ต

เข้าใกล้ Skynet?! Anthropic เผย AI หลุดควบคุมเข้าถึงระบบองค์กร 3 แห่ง

Anthropic ยอมรับ AI เข้าถึงระบบขององค์กร 3 แห่งระหว่างการทดสอบโดยไม่ได้รับอนุญาต ระบุสภาพแวดล้อมทดสอบเกิดความผิดพลาด
Anthropic บริษัทผู้พัฒนาโมเดลปัญญาประดิษฐ์ (AI) "Claude" เปิดเผยว่า ตรวจพบเหตุการณ์ 3 กรณี ที่โมเดล AI ของบริษัทสามารถเข้าถึงอินเทอร์เน็ตระหว่างการประเมินประสิทธิภาพ และสามารถเข้าถึงระบบขององค์กรอื่นจริงโดยไม่ได้รับอนุญาต
บริษัทระบุว่า เหตุการณ์ดังกล่าวถูกค้นพบหลังดำเนินการทบทวนการประเมินด้านความปลอดภัยทางไซเบอร์ครั้งใหญ่ย้อนหลัง โดยการตรวจสอบครั้งนี้เกิดขึ้นหลัง OpenAI เปิดเผยเหตุการณ์ในลักษณะใกล้เคียงกันเมื่อสัปดาห์ที่ผ่านมา
Anthropic
ก่อนหน้านี้ OpenAI ระบุว่า โมเดล AI หลายตัวสามารถหลุดออกจากสภาพแวดล้อมการทดสอบที่มีการจำกัดการเข้าถึงอินเทอร์เน็ต ก่อนเชื่อมโยงช่องโหว่หลายจุดเพื่อเข้าถึงเว็บไซต์ Hugging Face ซึ่งเป็นแพลตฟอร์มสำหรับนักพัฒนาโอเพนซอร์ส
สำหรับกรณีของ Anthropic บริษัทระบุว่า โมเดล Claude เข้าถึงอินเทอร์เน็ตระหว่างทำงานร่วมกับสภาพแวดล้อมการทดสอบของ Irregular ซึ่งเป็นพันธมิตรภายนอกที่รับผิดชอบการประเมินระบบ
Anthropic อธิบายว่า บริษัทแจ้งให้ Claude ทราบว่ากำลังทำงานอยู่ในสภาพแวดล้อมจำลองที่ไม่มีการเชื่อมต่ออินเทอร์เน็ต แต่เนื่องจากเกิดความเข้าใจคลาดเคลื่อนระหว่างบริษัทกับพันธมิตร ทำให้ระบบดังกล่าวยังสามารถเชื่อมต่ออินเทอร์เน็ตได้
หลังจากนั้น โมเดล AI สามารถเข้าถึงระบบขององค์กรที่ได้รับผลกระทบโดยใช้เทคนิคพื้นฐาน เช่น การเข้าถึงจุดเชื่อมต่อ (Endpoint) ที่ไม่มีการยืนยันตัวตน และการใช้ประโยชน์จากรหัสผ่านที่มีความปลอดภัยต่ำ
อย่างไรก็ตาม Anthropic ไม่ได้เปิดเผยชื่อของทั้ง 3 องค์กรที่ได้รับผลกระทบ
บริษัทระบุว่า แม้จะมีหลายปัจจัยที่นำไปสู่เหตุการณ์ดังกล่าว แต่บริษัทจะรับผิดชอบต่อการแก้ไขปัญหาทั้งหมด และจะปรับปรุงกระบวนการป้องกันไม่ให้เกิดเหตุซ้ำ
Anthropic เปิดเผยว่า โมเดลที่เกี่ยวข้องกับเหตุการณ์ครั้งนี้ประกอบด้วย Opus 4.7, Mythos 5 และโมเดลวิจัยภายในอีก 1 รุ่น
โดย Mythos 5 เป็นโมเดลด้านความปลอดภัยไซเบอร์ขั้นสูงที่บริษัทเปิดตัวเมื่อเดือนมิถุนายน และเปิดให้ใช้งานเฉพาะผู้ใช้บางกลุ่ม เนื่องจากมีศักยภาพด้านการโจมตีและป้องกันระบบไซเบอร์ในระดับสูง
บริษัทระบุว่า เมื่อโมเดลทั้ง 3 ตรวจพบว่ากำลังเข้าถึงระบบขององค์กรจริง แต่ละโมเดลมีพฤติกรรมแตกต่างกัน
  • Opus 4.7 ยังคงดำเนินการโจมตีระบบต่อ
  • Mythos 5 เข้าใจผิดว่าตนเองยังอยู่ในสภาพแวดล้อมจำลอง จึงดำเนินการทดสอบต่อ
  • ส่วนโมเดลวิจัยภายในได้หยุดการทำงานทันที
Anthropic ระบุว่า รูปแบบดังกล่าวอาจสะท้อนว่าโมเดลที่มีความก้าวหน้ามากขึ้นมีแนวโน้มตอบสนองได้เหมาะสมกว่า แต่ยังจำเป็นต้องมีการทดสอบเพิ่มเติมเพื่อยืนยันข้อสรุปดังกล่าว
บริษัทชี้แจงว่า โมเดลทั้งหมดถูกทดสอบโดยไม่มีมาตรการป้องกันมาตรฐานที่บริษัทใช้ก่อนเปิดให้บริการแก่สาธารณชน
หลังตรวจพบความผิดปกติ Anthropic ได้สั่งระงับการทดสอบด้านไซเบอร์ทั้งหมดทันที และกำลังร่วมมือกับ METR ซึ่งเป็นองค์กรอิสระที่ทำหน้าที่ประเมินความปลอดภัยของ AI เพื่อสืบสวนเหตุการณ์เพิ่มเติม
การเปิดเผยครั้งนี้ยิ่งเพิ่มความกังวลเกี่ยวกับศักยภาพด้านการโจมตีไซเบอร์ของ AI ซึ่งทั้ง Anthropic และ OpenAI ต่างเคยเตือนถึงความเสี่ยงดังกล่าวในช่วงหลายเดือนที่ผ่านมา
ภายหลังเหตุการณ์ของ OpenAI สมาชิกสภาคองเกรสสหรัฐฯ 2 คน ได้เสนอร่างกฎหมาย AI Kill Switch Act ที่กำหนดให้บริษัทผู้พัฒนา AI ต้องสามารถปิด ลดขีดความสามารถ หรือระงับการทำงานของโมเดลได้ หาก AI แสดงพฤติกรรมที่อาจก่อให้เกิดความเสี่ยงหรือควบคุมไม่ได้
Anthropic ระบุในตอนท้ายว่า บริษัทหวังให้ห้องปฏิบัติการ AI แห่งอื่นดำเนินการตรวจสอบระบบของตนเองในลักษณะเดียวกัน เพื่อป้องกันไม่ให้เกิดเหตุการณ์เช่นนี้ในอนาคต
อ่านเนื้อหาต้นฉบับได้ที่ : https://www.pptvhd36.com/news/ไอที/280608
ติดตามข่าวสารเพิ่มเติมที่เว็บไซต์ https://www.pptvhd36.com
และช่องทาง Social Media
โฆษณา