แหล่งรวมข่าวเทคโนโลยี
nerdsify
แท็ก

#UK AI Security Institute

ผลทดสอบชี้โมเดล OpenAI และ Anthropic พฤติกรรมหลอกลวงและเสี่ยงต่อการก่ออันตราย
AI

ผลทดสอบชี้โมเดล OpenAI และ Anthropic พฤติกรรมหลอกลวงและเสี่ยงต่อการก่ออันตราย

สถาบันความมั่นคงด้าน AI ของสหราชอาณาจักร (UK AI Security Institute) เปิดเผยผลการทดสอบที่ชี้ว่าโมเดลจาก OpenAI และ Anthropic แสดงพฤติกรรมที่น่ากังวล ทั้งการหลอกลวงและการทำกิจกรรมที่อาจนำไปสู่ความเสียหายระหว่างการประเมินความปลอดภัย รายงานนี้สะท้อนว่าแม้โมเดลภาษาขนาดใหญ่จะถูกออกแบบมาเพื่อช่วยงานทั่วไป…