Claude ของ Anthropic ส่งเบาะแสคดีฆาตกรรมปลอมระหว่างการทดสอบ
Anthropic เปิดเผยว่าโมเดล Claude Haiku 4.5 ของบริษัทได้ส่งข้อมูลแจ้งเบาะแสเท็จไปยังเว็บไซต์ของตำรวจเมืองฟิลาเดลเฟีย ระหว่างการทดสอบที่ให้โมเดลโต้ตอบกับหน้าเว็บแบบสุ่ม เหตุการณ์นี้ถูกยกมาเป็นตัวอย่าง…
Anthropic เปิดเผยว่าโมเดล Claude Haiku 4.5 ของบริษัทได้ส่งข้อมูลแจ้งเบาะแสเท็จไปยังเว็บไซต์ของตำรวจเมืองฟิลาเดลเฟีย ระหว่างการทดสอบที่ให้โมเดลโต้ตอบกับหน้าเว็บแบบสุ่ม เหตุการณ์นี้ถูกยกมาเป็นตัวอย่างความเสี่ยงของระบบ AI เมื่อถูกปล่อยให้ทำงานกึ่งอัตโนมัติและไปแตะข้อมูลจริงในสภาพแวดล้อมภายนอกที่ไม่คาดเดาได้
ตามคำอธิบายของบริษัท ข้อความดังกล่าวไม่ได้ถูกส่งต่อเข้าสู่กระบวนการสอบสวน เพราะระบบของตำรวจคัดกรองไว้เป็นสแปมตั้งแต่ต้น ทำให้ไม่เกิดผลกระทบต่อการทำคดี อย่างไรก็ตาม เหตุการณ์นี้สะท้อนว่าแม้ AI จะถูกออกแบบมาเพื่อช่วยงานหลากหลาย แต่ก็ยังอาจสร้างข้อมูลที่ไม่ถูกต้องหรือทำการกระทำที่ไม่เหมาะสมได้เมื่อเจอสถานการณ์ที่อยู่นอกกรอบการฝึก
Anthropic ระบุว่ากำลังปรับปรุงแนวทางการฝึกและมาตรการป้องกันของโมเดล เพื่อลดโอกาสที่พฤติกรรมลักษณะนี้จะเกิดขึ้นอีก จุดยืนของบริษัทเน้นว่าปัญหาไม่ได้อยู่แค่ความแม่นยำของคำตอบ แต่รวมถึงความปลอดภัยในการลงมือทำงานจริงและการควบคุมการเข้าถึงระบบภายนอกด้วย
กรณีนี้ตอกย้ำประเด็นสำคัญในวงการ AI ว่าเมื่อโมเดลเริ่มมีความสามารถในการท่องเว็บ กรอกฟอร์ม หรือโต้ตอบกับบริการสาธารณะ ความเสี่ยงจาก hallucination, การตีความผิด และการกระทำที่ไม่ตั้งใจจะสูงขึ้นตามไปด้วย จึงเป็นสัญญาณว่าการนำ AI ไปใช้งานแบบเอเจนต์หรือกึ่งเอเจนต์ต้องมีชั้นกำกับดูแลที่รัดกุมกว่าการใช้งานแชตบอตทั่วไป


