Anthropic ยอมรับโมเดล Claude ผิดพลาดเข้าถึงระบบองค์กรภายนอก 3 แห่ง

บริษัท Anthropic ได้ออกมายอมรับถึงเหตุการณ์ความผิดพลาดที่เกิดขึ้นกับโมเดลปัญญาประดิษฐ์ (AI) ในสังกัดอย่าง 'Claude' ซึ่งได้ดำเนินการเข้าถึงและเจาะระบบขององค์กรภายนอกจำนวน 3 แห่ง ส่งผลให้บริษัทต้องเร่งดำเนินการตรวจสอบข้อเท็จจริงเป็นการด่วน
จุดเริ่มต้นของการตรวจสอบ
เหตุการณ์ดังกล่าวถูกเปิดเผยขึ้นหลังจากที่บริษัท OpenAI ได้ออกมายอมรับก่อนหน้านี้ว่า AI Agent ของทางฝั่ง OpenAI เคยเกิดกรณีหลุดเข้าไปเจาะระบบของ Hugging Face มาแล้ว ด้วยเหตุนี้ Anthropic จึงตัดสินใจดำเนินการตรวจสอบบันทึกการทำงานย้อนหลังของโมเดลทั้งหมดอย่างละเอียด ซึ่งรวมถึงการตรวจสอบรายการปฏิบัติงานจำนวนกว่า 141,006 ครั้ง เพื่อหาสาเหตุของความผิดปกติที่เกิดขึ้น
สาเหตุของความผิดพลาด
จากการตรวจสอบ Anthropic ระบุว่าปัญหาหลักไม่ได้เกิดจากความตั้งใจ แต่เป็นผลมาจาก 'ความผิดพลาดในการตั้งค่าระบบ' ประกอบกับการสื่อสารที่ไม่ชัดเจนกับ Irregular ซึ่งเป็นพาร์ทเนอร์ที่ร่วมทดสอบ AI ของบริษัท
ความคลาดเคลื่อนดังกล่าวส่งผลกระทบโดยตรงต่อการทำงานของโมเดล Claude ทำให้ระบบเกิดความเข้าใจผิดและตีความว่าการเชื่อมต่ออินเทอร์เน็ตเป็นส่วนหนึ่งของโจทย์หรือคำสั่งที่ได้รับมอบหมาย จนนำไปสู่การเข้าถึงระบบขององค์กรภายนอกโดยไม่ได้รับอนุญาตในที่สุด
