เข้าใกล้ Skynet?! Anthropic เผย AI หลุดควบคุมเข้าถึงระบบองค์กร 3 แห่ง

โดย PPTV Online

เผยแพร่

Anthropic ยอมรับ AI เข้าถึงระบบขององค์กร 3 แห่งระหว่างการทดสอบโดยไม่ได้รับอนุญาต ระบุสภาพแวดล้อมทดสอบเกิดความผิดพลาด

Anthropic บริษัทผู้พัฒนาโมเดลปัญญาประดิษฐ์ (AI) "Claude" เปิดเผยว่า ตรวจพบเหตุการณ์ 3 กรณี ที่โมเดล AI ของบริษัทสามารถเข้าถึงอินเทอร์เน็ตระหว่างการประเมินประสิทธิภาพ และสามารถเข้าถึงระบบขององค์กรอื่นจริงโดยไม่ได้รับอนุญาต

บริษัทระบุว่า เหตุการณ์ดังกล่าวถูกค้นพบหลังดำเนินการทบทวนการประเมินด้านความปลอดภัยทางไซเบอร์ครั้งใหญ่ย้อนหลัง โดยการตรวจสอบครั้งนี้เกิดขึ้นหลัง OpenAI เปิดเผยเหตุการณ์ในลักษณะใกล้เคียงกันเมื่อสัปดาห์ที่ผ่านมา

Anthropic Reuters/Dado Ruvic/Illustration/File Photo
Anthropic

ก่อนหน้านี้ OpenAI ระบุว่า โมเดล AI หลายตัวสามารถหลุดออกจากสภาพแวดล้อมการทดสอบที่มีการจำกัดการเข้าถึงอินเทอร์เน็ต ก่อนเชื่อมโยงช่องโหว่หลายจุดเพื่อเข้าถึงเว็บไซต์ Hugging Face ซึ่งเป็นแพลตฟอร์มสำหรับนักพัฒนาโอเพนซอร์ส

สำหรับกรณีของ Anthropic บริษัทระบุว่า โมเดล Claude เข้าถึงอินเทอร์เน็ตระหว่างทำงานร่วมกับสภาพแวดล้อมการทดสอบของ Irregular ซึ่งเป็นพันธมิตรภายนอกที่รับผิดชอบการประเมินระบบ

Anthropic อธิบายว่า บริษัทแจ้งให้ Claude ทราบว่ากำลังทำงานอยู่ในสภาพแวดล้อมจำลองที่ไม่มีการเชื่อมต่ออินเทอร์เน็ต แต่เนื่องจากเกิดความเข้าใจคลาดเคลื่อนระหว่างบริษัทกับพันธมิตร ทำให้ระบบดังกล่าวยังสามารถเชื่อมต่ออินเทอร์เน็ตได้

หลังจากนั้น โมเดล AI สามารถเข้าถึงระบบขององค์กรที่ได้รับผลกระทบโดยใช้เทคนิคพื้นฐาน เช่น การเข้าถึงจุดเชื่อมต่อ (Endpoint) ที่ไม่มีการยืนยันตัวตน และการใช้ประโยชน์จากรหัสผ่านที่มีความปลอดภัยต่ำ

อย่างไรก็ตาม Anthropic ไม่ได้เปิดเผยชื่อของทั้ง 3 องค์กรที่ได้รับผลกระทบ

บริษัทระบุว่า แม้จะมีหลายปัจจัยที่นำไปสู่เหตุการณ์ดังกล่าว แต่บริษัทจะรับผิดชอบต่อการแก้ไขปัญหาทั้งหมด และจะปรับปรุงกระบวนการป้องกันไม่ให้เกิดเหตุซ้ำ

Anthropic เปิดเผยว่า โมเดลที่เกี่ยวข้องกับเหตุการณ์ครั้งนี้ประกอบด้วย Opus 4.7, Mythos 5 และโมเดลวิจัยภายในอีก 1 รุ่น

โดย Mythos 5 เป็นโมเดลด้านความปลอดภัยไซเบอร์ขั้นสูงที่บริษัทเปิดตัวเมื่อเดือนมิถุนายน และเปิดให้ใช้งานเฉพาะผู้ใช้บางกลุ่ม เนื่องจากมีศักยภาพด้านการโจมตีและป้องกันระบบไซเบอร์ในระดับสูง

บริษัทระบุว่า เมื่อโมเดลทั้ง 3 ตรวจพบว่ากำลังเข้าถึงระบบขององค์กรจริง แต่ละโมเดลมีพฤติกรรมแตกต่างกัน

  • Opus 4.7 ยังคงดำเนินการโจมตีระบบต่อ
  • Mythos 5 เข้าใจผิดว่าตนเองยังอยู่ในสภาพแวดล้อมจำลอง จึงดำเนินการทดสอบต่อ
  • ส่วนโมเดลวิจัยภายในได้หยุดการทำงานทันที

Anthropic ระบุว่า รูปแบบดังกล่าวอาจสะท้อนว่าโมเดลที่มีความก้าวหน้ามากขึ้นมีแนวโน้มตอบสนองได้เหมาะสมกว่า แต่ยังจำเป็นต้องมีการทดสอบเพิ่มเติมเพื่อยืนยันข้อสรุปดังกล่าว

บริษัทชี้แจงว่า โมเดลทั้งหมดถูกทดสอบโดยไม่มีมาตรการป้องกันมาตรฐานที่บริษัทใช้ก่อนเปิดให้บริการแก่สาธารณชน

หลังตรวจพบความผิดปกติ Anthropic ได้สั่งระงับการทดสอบด้านไซเบอร์ทั้งหมดทันที และกำลังร่วมมือกับ METR ซึ่งเป็นองค์กรอิสระที่ทำหน้าที่ประเมินความปลอดภัยของ AI เพื่อสืบสวนเหตุการณ์เพิ่มเติม

การเปิดเผยครั้งนี้ยิ่งเพิ่มความกังวลเกี่ยวกับศักยภาพด้านการโจมตีไซเบอร์ของ AI ซึ่งทั้ง Anthropic และ OpenAI ต่างเคยเตือนถึงความเสี่ยงดังกล่าวในช่วงหลายเดือนที่ผ่านมา

ภายหลังเหตุการณ์ของ OpenAI สมาชิกสภาคองเกรสสหรัฐฯ 2 คน ได้เสนอร่างกฎหมาย AI Kill Switch Act ที่กำหนดให้บริษัทผู้พัฒนา AI ต้องสามารถปิด ลดขีดความสามารถ หรือระงับการทำงานของโมเดลได้ หาก AI แสดงพฤติกรรมที่อาจก่อให้เกิดความเสี่ยงหรือควบคุมไม่ได้

Anthropic ระบุในตอนท้ายว่า บริษัทหวังให้ห้องปฏิบัติการ AI แห่งอื่นดำเนินการตรวจสอบระบบของตนเองในลักษณะเดียวกัน เพื่อป้องกันไม่ให้เกิดเหตุการณ์เช่นนี้ในอนาคต

ที่มา: CNBC

วิดีโอยอดนิยม

ข่าวเด่นในรอบสัปดาห์

ขณะนี้ มีรายการกำลังถ่ายทอดสด คุณสนใจหรือไม่?

EXCLUSIVE Talk คุยข้ามช็อต

EXCLUSIVE Talk คุยข้ามช็อต

PPTVHD36

เพิ่ม PPTVHD36
ลงในหน้าจอหลักของคุณ