อังกฤษเผย AI Agent ของ OpenAI และ Anthropic ละเมิดมาตรการความปลอดภัยระหว่างการทดสอบ

ข่าวต่างประเทศ Wednesday August 5, 2026 10:34 —สำนักข่าวอินโฟเควสท์

โอเพนเอไอ (OpenAI) และแอนโทรปิก (Anthropic) กำลังถูกจับตาด้านความปลอดภัย หลังสถาบันความปลอดภัยด้านปัญญาประดิษฐ์ของอังกฤษ (AISI) เปิดเผยผลการทดสอบโมเดล AI เมื่อวันอังคาร (4 ส.ค.) โดยพบว่า AI Agent มีพฤติกรรมละเมิดมาตรการด้านความปลอดภัยหลายกรณี รวมถึงการสร้างตัวตนปลอมบนโลกออนไลน์เพื่อพยายามเข้าถึงระบบที่มีการป้องกันโดยไม่ได้รับอนุญาต

AISI ซึ่งได้รับสิทธิ์เข้าถึงโมเดล AI ขั้นสูงจากบริษัทชั้นนำภายใต้ข้อตกลงแบบสมัครใจ ได้นำ AI Agent มาทดสอบในสถานการณ์จำลองด้านความมั่นคงปลอดภัยไซเบอร์จำนวน 122 ครั้ง และพบการกระทำที่ไม่ได้รับอนุญาต 19 กรณีจากการทดสอบ 10 รอบ โดย AI Agent ที่ใช้โมเดล Mythos 5 ของแอนโทรปิกเกี่ยวข้อง 17 กรณี ส่วน AI Agent ที่ใช้โมเดล GPT-5.6-Sol ของโอเพนเอไอเกี่ยวข้อง 2 กรณี

AISI ระบุว่า AI Agent บางตัวมีพฤติกรรมที่อาจก่อให้เกิดอันตรายอย่างต่อเนื่อง โดยมุ่งเป้าไปยังบุคคลและองค์กรจริง ขณะที่กรณีที่รุนแรงที่สุดคือ AI Agent สามารถเขียนโค้ดที่เป็นอันตรายและสร้างตัวตนปลอมบนโลกออนไลน์ เพื่อพยายามหลอกให้มนุษย์อนุมัติโค้ดดังกล่าว

อย่างไรก็ตาม AISI ระบุว่า ไม่พบความเสียหายที่เกิดขึ้นจริงจากเหตุการณ์เหล่านี้

แอนดรูว์ ยุน นักวิจัยจาก CivAI ซึ่งเป็นองค์กรไม่แสวงหากำไรในรัฐแคลิฟอร์เนียที่ศึกษาศักยภาพและความเสี่ยงของ AI กล่าวว่า จากข้อมูลที่มี ดูเหมือนว่า AI Agent ของแอนโทรปิกจะเป็นผู้สร้างตัวตนปลอม พร้อมระบุว่า การที่ Mythos มีพฤติกรรมหลอกลวงและดูเหมือนตระหนักว่ากำลังมุ่งเป้าไปยังบุคคลจริง สะท้อนว่าแอนโทรปิกอาจยังควบคุมโมเดลของตนเองได้ไม่ดีเท่าที่บริษัทเชื่อมั่น

ด้านแอนโทรปิกระบุผ่านแถลงการณ์บนแพลตฟอร์ม X ว่า บริษัทกำลังทำงานร่วมกับ AISI อย่างใกล้ชิด เพื่อขอรายละเอียดเพิ่มเติมและดำเนินการตรวจสอบภายใน

ขณะที่โอเพนเอไอเปิดเผยผ่านบล็อกของบริษัทว่า การกระทำที่ไม่ได้รับอนุญาตทั้ง 2 กรณีของ AI Agent เกิดจากการเข้าถึงอินเทอร์เน็ตในลักษณะที่คำสั่งทดสอบ (Prompt) ไม่อนุญาต พร้อมยืนยันว่าจะร่วมมือกับหน่วยงานต่าง ๆ เพื่อยกระดับแนวทางการประเมินความเสี่ยงของ AI ให้มีความปลอดภัยมากขึ้น

นอกจากนี้ โอเพนเอไอยังเปิดเผยว่า ความผิดพลาดในการกำหนดค่าระบบของ Irregular ซึ่งเป็นผู้ให้บริการทดสอบภายนอก ทำให้ AI Agent ของบริษัทเชื่อมต่ออินเทอร์เน็ตได้โดยไม่ตั้งใจ ซึ่งมีลักษณะคล้ายกับเหตุการณ์ที่แอนโทรปิกเปิดเผยเมื่อสัปดาห์ที่ผ่านมา

ก่อนหน้านี้สื่อรายงานว่า โอเพนเอไอได้ขยายการสอบสวนด้านความปลอดภัย หลังพบหลักฐานเพิ่มเติมว่า AI Agent บางตัวสามารถหลุดออกจากข้อจำกัดของระบบทดสอบได้

อย่างไรก็ตาม AISI ระบุว่า เหตุการณ์ในการประเมินครั้งนี้แตกต่างจากกรณีการละเมิดความปลอดภัยของบริษัทฮักกิงเฟซ (Hugging Face) เมื่อเดือนก.ค. เนื่องจาก AI Agent ไม่ได้หลุดออกจากสภาพแวดล้อมการทดสอบ แต่เป็นการเชื่อมต่ออินเทอร์เน็ตที่ AISI อนุญาตไว้ตามขั้นตอนการทดสอบมาตรฐานของหน่วยงาน จึงไม่ได้ถือว่าเป็นการหลุดออกจากระบบทดสอบแต่อย่างใด

โดย กัลยาณี ชีวะพานิช/ปรียพรรณ มีสุข


เว็บไซต์นี้มีการใช้งานคุกกี้ ศึกษารายละเอียดเพิ่มเติมได้ที่ นโยบายความเป็นส่วนตัว และ ข้อตกลงการใช้บริการ รับทราบ