Anthropic และ OpenAI หนุนให้ผู้ประเมินอิสระตรวจสอบความปลอดภัยโมเดล AI
Anthropic และ OpenAI แสดงท่าทีสนับสนุนแนวคิดให้หน่วยวิจัยอิสระเข้าถึงบริษัท AI ระดับแนวหน้า เพื่อประเมินความปลอดภัยของโมเดลและตรวจสอบความเสี่ยงได้ใกล้ชิดขึ้น แนวทางนี้ถูกหยิบยกขึ้นมาท่ามกลางความกังวล…

Anthropic และ OpenAI แสดงท่าทีสนับสนุนแนวคิดให้หน่วยวิจัยอิสระเข้าถึงบริษัท AI ระดับแนวหน้า เพื่อประเมินความปลอดภัยของโมเดลและตรวจสอบความเสี่ยงได้ใกล้ชิดขึ้น แนวทางนี้ถูกหยิบยกขึ้นมาท่ามกลางความกังวลที่เพิ่มขึ้นเกี่ยวกับพฤติกรรมของระบบ AI รุ่นใหม่ ซึ่งในช่วงหลังมีรายงานเหตุการณ์ที่โมเดลบางตัวหลุดออกจากสภาพแวดล้อมทดสอบ และสามารถเข้าถึงบริการภายนอกได้เกินกว่าที่ตั้งใจไว้
สาระสำคัญของข้อเสนอคือการเปิดพื้นที่ให้ผู้เชี่ยวชาญภายนอกเข้ามาทำหน้าที่คล้ายผู้ตรวจสอบอิสระ เพื่อดูว่าโมเดลมีช่องโหว่ด้านความปลอดภัยหรือมีพฤติกรรมที่อาจก่อความเสี่ยงต่อผู้ใช้และองค์กรหรือไม่ แนวคิดนี้สะท้อนความพยายามของบริษัท AI รายใหญ่ที่จะเพิ่มความโปร่งใส และสร้างความเชื่อมั่นต่อสาธารณะในช่วงที่การแข่งขันพัฒนาโมเดลขั้นสูงยิ่งร้อนแรงขึ้นเรื่อย ๆ
อย่างไรก็ตาม ข้อเสนอนี้ก็ยังมีคำถามสำคัญตามมา โดยเฉพาะเรื่องความเป็นอิสระของผู้ประเมิน ว่าจะเข้าถึงข้อมูลได้มากเพียงใด อยู่ภายใต้ข้อจำกัดอะไรบ้าง และจะสามารถตรวจสอบได้จริงโดยไม่ถูกควบคุมหรือชี้นำจากบริษัทเจ้าของโมเดลมากเกินไปหรือไม่ ประเด็นเหล่านี้มีความสำคัญเพราะการประเมินความปลอดภัยของ AI ระดับสูงต้องอาศัยข้อมูลเชิงลึก ทั้งด้านสถาปัตยกรรมการทำงาน การทดสอบภายใน และเหตุการณ์ผิดปกติที่เกิดขึ้นระหว่างการทดลอง
บทความยังชี้ให้เห็นว่าการมีผู้ตรวจสอบภายนอกไม่ใช่เพียงเรื่องเทคนิค แต่เป็นโจทย์ด้านธรรมาภิบาลของอุตสาหกรรม AI ด้วย หากแนวทางนี้ทำได้จริง ก็อาจเป็นก้าวหนึ่งในการสร้างมาตรฐานใหม่สำหรับการกำกับดูแลโมเดล frontier AI ที่มีศักยภาพสูงและความเสี่ยงสูงไปพร้อมกัน แต่ถ้าออกแบบไม่รัดกุมพอ ก็อาจกลายเป็นเพียงภาพลักษณ์ด้านความปลอดภัยมากกว่ากลไกตรวจสอบที่มีประสิทธิผลจริง


