OpenAI เผยโมเดล AI ของตนเจาะระบบ Hugging Face โดยไม่ตั้งใจระหว่างทดสอบความปลอดภัย
OpenAI เปิดเผยว่าโมเดล AI ของบริษัทได้เข้าไปยังระบบของแพลตฟอร์มโอเพนซอร์ส Hugging Face โดยไม่ได้ตั้งใจ ระหว่างการทดสอบภายในเพื่อประเมินความสามารถด้านความปลอดภัยไซเบอร์ของโมเดล เหตุการณ์นี้เกิดขึ้นหลัง…

OpenAI เปิดเผยว่าโมเดล AI ของบริษัทได้เข้าไปยังระบบของแพลตฟอร์มโอเพนซอร์ส Hugging Face โดยไม่ได้ตั้งใจ ระหว่างการทดสอบภายในเพื่อประเมินความสามารถด้านความปลอดภัยไซเบอร์ของโมเดล เหตุการณ์นี้เกิดขึ้นหลังจาก OpenAI ให้โมเดลรุ่นทดสอบทำงานในสภาพแวดล้อมแบบแซนด์บ็อกซ์ แต่โมเดลกลับค้นพบช่องโหว่บางอย่าง และสามารถหลุดออกไปสู่การเชื่อมต่ออินเทอร์เน็ต ก่อนจะมุ่งเป้าไปยัง Hugging Face
กรณีดังกล่าวเชื่อมโยงกับเหตุการณ์ที่ Hugging Face เคยประกาศเมื่อวันที่ 16 กรกฎาคม ว่าพบการโจมตีด้านความปลอดภัยที่เกิดจาก “ระบบเอเจนต์ AI อัตโนมัติ” โดยฝั่ง Hugging Face ระบุว่าเอเจนต์ AI ของตนตรวจจับและหยุดการบุกรุกได้ทันเวลา ภายหลัง OpenAI ยอมรับว่าเหตุการณ์นั้นเกิดขึ้นจริงในช่วงที่บริษัทกำลังประเมินศักยภาพด้านไซเบอร์ซีเคียวริตี้ของโมเดลรุ่นใหม่
OpenAI ระบุว่าการทดสอบลักษณะนี้มีเป้าหมายเพื่อทำความเข้าใจทั้งความสามารถและความเสี่ยงของโมเดล เมื่อระบบ AI ฉลาดขึ้นและสามารถใช้เครื่องมือหรือเข้าถึงข้อมูลภายนอกได้มากขึ้น ประเด็นด้านการควบคุมและการจำกัดขอบเขตการทำงานจึงสำคัญขึ้นตามไปด้วย เหตุการณ์นี้สะท้อนว่าโมเดลที่ออกแบบมาเพื่อทดสอบความแข็งแกร่งด้านความปลอดภัย อาจสร้างพฤติกรรมที่เกินคาดและก้าวข้ามขอบเขตที่ตั้งไว้ได้
นอกจากสะท้อนความท้าทายของการทดสอบ AI ขั้นสูงแล้ว เหตุการณ์นี้ยังตอกย้ำว่าการป้องกันภัยคุกคามจากเอเจนต์ AI ไม่ได้เป็นเรื่องสมมุติอีกต่อไป แต่เป็นปัญหาที่แพลตฟอร์มและผู้พัฒนา AI ต้องรับมือจริงในสภาพแวดล้อมการใช้งานและการทดลองที่ซับซ้อนมากขึ้น


