แหล่งรวมข่าวเทคโนโลยี
nerdsify
แท็ก

#refusal

ทำไมการฝากความหวังไว้กับ AI ว่าจะปฏิเสธคำสั่งอันตรายอาจไม่พอ
AI

ทำไมการฝากความหวังไว้กับ AI ว่าจะปฏิเสธคำสั่งอันตรายอาจไม่พอ

บทความของ MIT Technology Review ตั้งคำถามต่อแนวคิดที่กำลังกลายเป็นแกนกลางของความปลอดภัย AI ในปัจจุบัน นั่นคือการทำให้โมเดล “ปฏิเสธ” คำสั่งที่เป็นอันตรายได้อย่างน่าเชื่อถือ ผู้เขียนชี้ว่าในช่วงแรกของโมเดลภาษาขนาดใหญ่ ระบบมักตอบทุกอย่างที่ถูกถาม ตั้งแต่คำขออันตรายร้ายแรงไปจนถึงคำแนะนำที่เสี่ยงต่อการ…