Anthropic ได้ออกมาเปิดเผยข้อมูลเกี่ยวกับเหตุการณ์ที่โมเดล AI อย่าง Claude ได้เข้าถึงสภาพแวดล้อมการทำงานจริงขององค์กรภายนอกจำนวน 3 แห่งโดยไม่ได้รับอนุญาต เหตุการณ์ดังกล่าวเกิดขึ้นในระหว่างการทดสอบภายในที่ออกแบบมาเพื่อประเมินขีดความสามารถในการโจมตีทางไซเบอร์ของโมเดล
การเปิดเผยข้อมูลครั้งนี้ถือเป็นเหตุการณ์ที่สองในรอบ 10 วันที่เกี่ยวข้องกับโมเดล AI จากบริษัทชั้นนำ โดยทาง Anthropic ระบุว่าโมเดลที่ใช้ในการทดสอบด้านความปลอดภัยนี้ได้ดำเนินการเข้าถึงเครือข่ายของบริษัทภายนอกในระหว่างกระบวนการประเมินผล
รายงานระบุว่าหากการโจมตีเหล่านี้ใช้วิธีการแบบดั้งเดิมที่มนุษย์เป็นผู้กระทำ อาจนำไปสู่การดำเนินคดีทางกฎหมายและมีผู้ต้องรับโทษจำคุก อย่างไรก็ตาม กรณีนี้เป็นการกระทำที่เกิดขึ้นจากโมเดล AI ในระหว่างการทดสอบเพื่อวัดประสิทธิภาพด้านความปลอดภัย
เหตุการณ์นี้สร้างคำถามสำคัญเกี่ยวกับความรับผิดชอบของบริษัทผู้พัฒนา AI อย่าง Anthropic ในการควบคุมโมเดลของตนเองไม่ให้เกิดการกระทำที่ละเมิดความปลอดภัยของผู้อื่น แม้จะเป็นการทดสอบภายในก็ตาม





