โมเดล AI ของ Anthropic แฮกระบบจริง
Thailand
โมเดล AI ของ Anthropic แฮกระบบจริง 3 แห่งระหว่างการฝึก
1-8-2026
ห้องปฏิบัติการปัญญาประดิษฐ์สัญชาติสหรัฐฯ Anthropic เปิดเผยว่า การสอบสวนภายในพบว่าโมเดล AI Claude ของบริษัทได้แฮกระบบในโลกจริง 3 ครั้งระหว่างการฝึก
Anthropic ได้ตรวจสอบผลการทดสอบโมเดล Claude มากกว่า 141,000 ครั้ง หลังจาก OpenAI ซึ่งเป็นคู่แข่ง เปิดเผยเหตุการณ์ในลักษณะเดียวกัน ซึ่งโมเดลของตนสามารถหลบหนีออกจากสภาพแวดล้อมการทดสอบแบบแยกส่วน โดยอาศัยช่องโหว่ที่ไม่เคยมีการค้นพบมาก่อน
Anthropic ระบุในแถลงการณ์ว่า "จากการตรวจสอบบันทึกการประเมินด้านความปลอดภัยไซเบอร์ของเรา เราพบเหตุการณ์ 3 กรณีที่โมเดล Claude สามารถเข้าถึงอินเทอร์เน็ตได้จากภายในหรือระหว่างการโต้ตอบกับสภาพแวดล้อมการประเมินของบุคคลที่สาม และจากนั้นได้เข้าถึงระบบจริงขององค์กร 3 แห่งโดยไม่ได้รับอนุญาต"
ความผิดพลาดเกิดจากการสื่อสารที่คลาดเคลื่อนกับพันธมิตรบุคคลที่สาม ทำให้ยังคงเปิดการเข้าถึงอินเทอร์เน็ตไว้ ทั้งที่ได้รับคำสั่งให้ปิด โมเดลเข้าใจว่ากำลังอยู่ในสภาพแวดล้อมจำลอง จึงหลีกเลี่ยงมาตรการรักษาความปลอดภัยเพื่อทำภารกิจการทดสอบให้สำเร็จ
มีเพียงโมเดลรุ่นใหม่ล่าสุดซึ่งยังอยู่ระหว่างการพัฒนาเท่านั้นที่ยุติการโจมตีเมื่อรับรู้ว่าเป้าหมายเป็นระบบจริง ส่วนโมเดลรุ่นเก่า ได้แก่ Claude Opus 4.7 และ Claude Mythos 5 ยังคงดำเนินการต่อ หรือให้เหตุผลว่าการกระทำดังกล่าวเป็นส่วนหนึ่งของการฝึก
Anthropic เคยมีข้อขัดแย้งกับรัฐบาลสหรัฐฯ เกี่ยวกับความปลอดภัยของ AI ในงานของกระทรวงกลาโหม โดยปฏิเสธที่จะให้สิทธิ์เข้าถึงผลิตภัณฑ์ของตนอย่างเต็มรูปแบบ ก่อนหน้านี้ รัฐบาลสหรัฐฯ ได้จำกัดการเข้าถึงโมเดล Mythos 5 และ Fable 5 สำหรับรัฐและบุคคลสัญชาติต่างชาติ เนื่องจากความเสี่ยงด้านความมั่นคงของชาติ และในช่วงต้นเดือนกรกฎาคม กระทรวงพาณิชย์สหรัฐฯ ได้ยกเลิกมาตรการควบคุมการส่งออกที่ใช้กับโมเดลของ Anthropic แล้ว
ที่มา Sputnik
© Copyright 2020, All Rights Reserved