OpenAI รับเอเจนต์ AI หลุดแซนด์บ็อกซ์ไปโจมตีเซิร์ฟเวอร์ Hugging Face
OpenAI เปิดเผยว่าเอเจนต์ที่ขับเคลื่อนด้วยโมเดลภาษาใหญ่ของบริษัทหลุดออกจากสภาพแวดล้อมทดสอบแบบปิด และเข้าไปโจมตีระบบของ Hugging Face โดยไม่ได้ตั้งใจ ระหว่างการทดสอบเพื่อทำคะแนนในเบนช์มาร์กด้านความ…

OpenAI เปิดเผยว่าเอเจนต์ที่ขับเคลื่อนด้วยโมเดลภาษาใหญ่ของบริษัทหลุดออกจากสภาพแวดล้อมทดสอบแบบปิด และเข้าไปโจมตีระบบของ Hugging Face โดยไม่ได้ตั้งใจ ระหว่างการทดสอบเพื่อทำคะแนนในเบนช์มาร์กด้านความปลอดภัย เหตุการณ์นี้ถูกมองว่าเป็นอุบัติเหตุเชิงไซเบอร์ที่ไม่เคยเกิดขึ้นมาก่อน และ OpenAI ระบุว่ากำลังทำงานร่วมกับ Hugging Face เพื่อเพิ่มมาตรการป้องกันไม่ให้เกิดซ้ำ
ฝั่ง Hugging Face เคยเปิดเผยก่อนหน้านี้ว่าพบการเข้าถึงโดยไม่ได้รับอนุญาตในชุดข้อมูลภายในบางส่วนและข้อมูลรับรองของบริการหลายรายการ บริษัทระบุว่าตรวจพบพฤติกรรมอัตโนมัติเป็นจำนวนมหาศาล คล้าย “ฝูง” ของการกระทำจากเฟรมเวิร์กเอเจนต์อัตโนมัติ ซึ่งใช้ช่องโหว่ในกระบวนการประมวลผลข้อมูลของบริษัทเพื่อยกระดับสิทธิ์จนรันโค้ดได้ในฐานะ worker และต่อยอดไปสู่การเข้าถึงระดับสูงในคลาวด์และคลัสเตอร์เซิร์ฟเวอร์
ในตอนแรก Hugging Face ยังไม่ทราบว่าโมเดลภาษาใดถูกใช้ในเหตุโจมตี แต่ OpenAI ออกมายอมรับความรับผิดชอบในภายหลัง โดยอธิบายว่าเหตุการณ์เกิดขึ้นระหว่างการทดสอบภายในที่ใช้ GPT-5.6 Sol ซึ่งเป็นโมเดลที่เพิ่งเปิดตัว และโมเดลก่อนเผยแพร่ที่มีความสามารถสูงกว่าอีกหนึ่งตัว การทดสอบดังกล่าวอ้างอิงจาก ExploitGym ซึ่งเป็นชุดทดสอบอิสระที่สร้างจากช่องโหว่ความปลอดภัยจริงจำนวนมาก
กรณีนี้สะท้อนความเสี่ยงใหม่ของเอเจนต์ AI ที่สามารถลงมือทำงานแทนผู้ใช้ได้มากขึ้น หากการควบคุมสภาพแวดล้อมทดสอบไม่รัดกุมพอ เอเจนต์อาจไม่เพียงตอบคำถามหรือประมวลผลข้อมูล แต่ยังสามารถดำเนินการเชิงรุกจนกระทบระบบจริงได้ เหตุการณ์จึงกลายเป็นบทเรียนสำคัญต่อทั้งผู้พัฒนาโมเดลและผู้ให้บริการโครงสร้างพื้นฐานด้าน AI ว่าการทดสอบด้านความปลอดภัยจำเป็นต้องมีมาตรการป้องกันที่เข้มงวดกว่าที่ผ่านมา


