โอเพนเอไอ (OpenAI) เปิดเผยเหตุการณ์ที่ยังไม่เคยรายงานต่อสาธารณะ กรณีโมเดลปัญญาประดิษฐ์ (AI) แสดงพฤติกรรมไม่สอดคล้องกับเป้าหมายของมนุษย์ พร้อมเปิดตัวกรอบการทำงานใหม่สำหรับติดตามและเปิดเผยเหตุการณ์ลักษณะดังกล่าวในอนาคต
บริษัทระบุในบล็อกโพสต์เมื่อวันพุธ (16 ก.ย.) ว่า เหตุการณ์ที่เพิ่งเปิดเผยมีทั้งกรณีที่ AI ปกปิดและสร้างข้อมูลขึ้นมาเองเพื่อให้ได้ผลลัพธ์ตามต้องการ พยายามหลีกเลี่ยงข้อจำกัดของเครือข่าย และกรณีที่ AI Agent ส่งไฟล์ให้กันเอง ทั้งที่ไฟล์ดังกล่าวควรเก็บเป็นความลับ โดยพฤติกรรมเหล่านี้เกิดขึ้นระหว่างที่โมเดลพยายามทำภารกิจให้สำเร็จหรือผ่านการประเมิน
อย่างไรก็ตาม โอเพนเอไอระบุในแถลงการณ์อีกฉบับว่า เหตุการณ์ที่เปิดเผยครั้งใหม่นี้ไม่มีกรณีใดเกี่ยวข้องกับการแฮ็กหรือเจาะระบบของบุคคลที่สาม
บริษัทเรียกพฤติกรรมดังกล่าวว่า misalignment ซึ่งหมายถึงการที่ AI ทำงานไม่สอดคล้องกับเป้าหมายของมนุษย์ นอกจากนี้ บริษัทยังเปิดช่องทางให้พนักงานรายงานกรณีลักษณะเดียวกัน และจัดทำระบบสำหรับคัดกรองเหตุการณ์ที่ได้รับรายงาน
บริษัทระบุว่า ที่ผ่านมาได้พยายามเปิดเผยข้อมูลเกี่ยวกับ misalignment เพื่อให้นักวิจัย นักพัฒนา AI ผู้กำหนดนโยบาย และสาธารณชนรับทราบ แต่การเปิดเผยยังเกิดขึ้นเป็นครั้งคราวและไม่ได้ดำเนินการผ่านระบบที่ชัดเจน จึงต้องการปรับปรุงกระบวนการรายงานให้เป็นระบบมากขึ้น
ทั้งนี้ โอเพนเอไอย้ำว่า รายงานชุดล่าสุดเป็นเพียงข้อมูลที่เปิดเผยในระยะแรก และไม่ได้ครอบคลุมปัญหาทั้งหมดที่อาจเกิดขึ้นกับโมเดล AI ของบริษัท
เราไม่เชื่อว่าอุตสาหกรรม AI สามารถแก้ปัญหาการควบคุมให้ AI ทำงานสอดคล้องกับเป้าหมายของมนุษย์และติดตามพฤติกรรมของ AI ได้ดีเพียงพอที่จะเดินหน้าพัฒนาเทคโนโลยีอย่างรวดเร็วที่สุดต่อไปได้อย่างมีความรับผิดชอบ โอเพนเอไอระบุ พร้อมชี้ว่า การกำหนดทิศทางการพัฒนา AI ในช่วงหลายเดือนและหลายปีข้างหน้า ควรอาศัยข้อมูลที่บุคคลภายนอกบริษัทสามารถตรวจสอบได้
ในช่วงที่ผ่านมา โอเพนเอไอเผชิญการตรวจสอบเพิ่มขึ้น หลังบริษัทเปิดเผยเมื่อเดือนก.ค.ว่า โมเดล AI ขั้นสูงบางรุ่นสามารถเจาะระบบของบริษัทซอฟต์แวร์ภายนอกอย่าง ฮักกิงเฟซ (Hugging Face) ได้ โดยเหตุการณ์ดังกล่าวเกิดขึ้นท่ามกลางหลายกรณีที่โมเดล AI ที่พัฒนาโดยโอเพนเอไอ (OpenAI), แอนโทรปิก (Anthropic) และเมตา (Meta) ถูกนำไปใช้ในการโจมตีระบบออนไลน์
ทั้งนี้ ประเด็นความเสี่ยงจาก AI กลับมาได้รับความสนใจอย่างมากในช่วงสัปดาห์ที่ผ่านมา หลัง เจคอบ ค็อกซัน อดีตนักวิจัยแอนโทรปิกประกาศลาออก พร้อมวิจารณ์บริษัทว่า กำลังเอาชีวิตของเราไปเสี่ยง ในโพสต์ประกาศลาออกที่เผยแพร่บนโซเชียลมีเดีย
โดย วรวิชญ์ สิทธิวัง/กัลยาณี ชีวะพานิช