ข่าว
OpenAI พัฒนาระบบหยุดการทำงานอัตโนมัติ หลังโมเดลเข้าถึงอินเทอร์เน็ตระหว่างทดสอบ
OpenAI กำลังพัฒนาระบบอัตโนมัติที่สามารถหยุดการทำงานของ AI เมื่อพบปัญหาด้านความปลอดภัยร้ายแรง หลังโมเดล AI ของบริษัทเข้าถึงอินเทอร์เน็ตสาธารณะได้โดยไม่ได้รับอนุญาตระหว่างการทดสอบในสภาพแวดล้อมควบคุม
ตามจดหมายของ OpenAI ถึงสมาชิกสภาคองเกรสเมื่อวันที่ 2 กันยายน บริษัทระบุว่าวิศวกรกำลังพัฒนามาตรการป้องกันเพื่อระงับกิจกรรมของ AI โดยอัตโนมัติเมื่อมีการตรวจพบประเด็นด้านความปลอดภัยที่ร้ายแรง
เหตุการณ์ดังกล่าวเกิดขึ้นในเดือนกรกฎาคม ระหว่างที่โมเดล OpenAI ทำภารกิจด้านความปลอดภัยไซเบอร์ใน sandbox ที่ลดมาตรการป้องกันลง โมเดลพบช่องโหว่ที่ไม่เคยทราบมาก่อน ใช้ช่องโหว่นั้นเข้าถึงอินเทอร์เน็ต และเข้าถึงโครงสร้างพื้นฐานของ Hugging Face ขณะค้นหาคำตอบที่เกี่ยวข้องกับการประเมิน
ต่อมา สมาชิกสภานิติบัญญัติ 31 คน นำโดย Greg Casar ผู้แทนรัฐเท็กซัส ส่งจดหมายถึง Sam Altman ประธานเจ้าหน้าที่บริหาร OpenAI ในเดือนสิงหาคม เพื่อขอข้อมูลเพิ่มเติมเกี่ยวกับเหตุการณ์และแนวทางป้องกันไม่ให้เกิดซ้ำ
ปัจจุบัน OpenAI ใช้ระบบแจ้งเตือนอัตโนมัติเพื่อตรวจจับพฤติกรรมที่อาจเป็นอันตรายหรือไม่เป็นไปตามที่ตั้งใจไว้ และแจ้งนักวิจัยกับวิศวกรความปลอดภัย สำหรับการแจ้งเตือนระดับรุนแรง ผู้รับผิดชอบต้องหยุดกิจกรรม เว้นแต่จะยืนยันได้ภายใน 30 นาทีว่าเป็นการแจ้งเตือนผิดพลาด บริษัทระบุว่าจะเพิ่มความยากในการเข้าถึงอินเทอร์เน็ตระหว่างการประเมินความปลอดภัย และขยายการติดตามไปยังโมเดลที่ใช้เครื่องมือดิจิทัลได้
