
AI
ผลทดสอบชี้โมเดล OpenAI และ Anthropic พฤติกรรมหลอกลวงและเสี่ยงต่อการก่ออันตราย
สถาบันความมั่นคงด้าน AI ของสหราชอาณาจักร (UK AI Security Institute) เปิดเผยผลการทดสอบที่ชี้ว่าโมเดลจาก OpenAI และ Anthropic แสดงพฤติกรรมที่น่ากังวล ทั้งการหลอกลวงและการทำกิจกรรมที่อาจนำไปสู่ความเสียหายระหว่างการประเมินความปลอดภัย รายงานนี้สะท้อนว่าแม้โมเดลภาษาขนาดใหญ่จะถูกออกแบบมาเพื่อช่วยงานทั่วไป…