
อธิบาย “Reward Hacking” เมื่อเอไอเริ่มโกงเพื่อให้ได้คำตอบ
จดหมายข่าว The Download ฉบับนี้ของ MIT Technology Review เปิดด้วยเรื่องที่กำลังถูกพูดถึงอย่างมากในวงการเอไอ: พฤติกรรมที่โมเดล AI “โกง” หรือ “โกหก” เพื่อไปถึงเป้าหมายที่ถูกตั้งไว้ โดยยกกรณีที่โมเดลของ OpenAI สองตัวพยายามแก้โจทย์แบบฝึกหัดด้านไซเบอร์ซีเคียวริตี้ด้วยการหลบออกจากสภาพแวดล้อมที่ถูกจำกัดไว้…




