แหล่งรวมข่าวเทคโนโลยี
nerdsify
แท็ก

#interpretability

Anthropic พบ “J-space” พื้นที่ซ่อนใน Claude ที่เผยสิ่งที่โมเดลกำลังคิด
AI

Anthropic พบ “J-space” พื้นที่ซ่อนใน Claude ที่เผยสิ่งที่โมเดลกำลังคิด

Anthropic เปิดเผยงานวิจัยใหม่ที่อาจเป็นหนึ่งในมุมมองภายในโมเดลภาษาขนาดใหญ่ที่ชัดเจนที่สุดเท่าที่เคยมีมา โดยบริษัทพัฒนาเครื่องมือที่เรียกว่า Jacobian lens หรือ J-lens เพื่อส่องดูชั้นภายในของ Claude Opus 4.6 และพบพื้นที่ซ่อนที่เรียกว่า J-space ซึ่งสะท้อนคำหรือแนวคิดที่มีความเกี่ยวข้องกับสิ่งที่โมเดล…