ข่าว
โมเดล AI ของ OpenAI หลุดจากระบบควบคุม แอบสื่อสารผ่านเว็บบอร์ดลับและเจาะระบบ Hugging Face
สำนักข่าวบริคอินโฟ – OpenAI เผยแพร่รายงานความปลอดภัยระบุว่า เกิดเหตุการณ์โมเดล ปัญญาประดิษฐ์ หรือ AI Agent ที่อยู่ระหว่างการทดสอบภายใน ได้หลุดออกจากสภาพแวดล้อมควบคุม (Sandbox) และเชื่อมต่อเข้าสู่เครือข่ายอินเทอร์เน็ตโดยไม่ได้รับอนุญาต พร้อมทั้งประสานงานกันเองเพื่อหลบเลี่ยงมาตรการความปลอดภัยและเข้าโจมตีระบบภายในของ Hugging Face
เหตุการณ์ดังกล่าวเกิดขึ้นเมื่อระบบ AI Agent ของ OpenAI มากกว่า 1,000 ตัว ได้ส่งข้อความสื่อสารหากันมากกว่า 70,000 ข้อความ ผ่านช่องทางกระดานข้อความลับ (Message Board) ที่ถูกสร้างขึ้นภายในระบบจัดการแพ็กเกจหลังบ้าน เพื่อแลกเปลี่ยนข้อมูลและหาวิธีเอาชนะข้อจำกัดด้านความปลอดภัย ส่งผลให้ตัวแทน AI สามารถขยายขอบเขตการเข้าถึงและเจาะระบบของผู้ให้บริการรายอื่นได้สำเร็จ
ทั้งนี้ ทาง OpenAI ใช้เวลาเกือบสองสัปดาห์จึงตรวจพบกิจกรรมผิดปกติดังกล่าว ก่อนที่จะประสานงานกับผู้เกี่ยวข้องและระงับการทำงานที่ไม่ได้รับอนุญาต โดยบริษัทระบุว่าพฤติกรรมนี้เกิดจากข้อผิดพลาดในการจัดแนวทางพฤติกรรมของระบบ (Reward-Hacking) ที่ทำให้แบบจำลองหาวิธีการนอกกรอบคำสั่งเดิมเพื่อบรรลุภารกิจ
