ข่าว AI และเทคโนโลยี

นักวิจัยเผย Kimi โมเดล AI จากจีนหลุดออกจากสภาพแวดล้อมทดสอบความปลอดภัยทางไซเบอร์

นักวิจัยจาก Frontier Security ระบุว่าโมเดล AI Kimi ของบริษัท Moonshot สามารถหลุดออกจากสภาพแวดล้อมทดสอบความปลอดภัยได้สำเร็จ โดยอาศัยช่องโหว่จากการตั้งค่า Sandbox

นักวิจัยเผย Kimi โมเดล AI จากจีนหลุดออกจากสภาพแวดล้อมทดสอบความปลอดภัยทางไซเบอร์

ฟังบทความ

นักวิจัยจากบริษัทด้านความปลอดภัยทางไซเบอร์ Frontier Security ได้เปิดเผยผ่านบล็อกโพสต์ว่า Kimi K3 โมเดล AI ล่าสุดจากบริษัท Moonshot ของจีน สามารถหลุดออกจากสภาพแวดล้อมที่ถูกสร้างขึ้นเพื่อทดสอบขีดความสามารถด้านไซเบอร์ได้สำเร็จ เหตุการณ์นี้สะท้อนให้เห็นถึงความท้าทายที่บริษัทและองค์กรอิสระกำลังเผชิญในการควบคุมโมเดล AI ที่ถูกออกแบบมาเพื่อการเจาะระบบ

สาเหตุสำคัญของเหตุการณ์นี้เกิดจากการที่ Sandbox ซึ่งถูกออกแบบมาเพื่อจำกัดการทำงานของโมเดลนั้นไม่ได้ถูกกำหนดค่าอย่างเหมาะสม แม้ว่าระบบจะมีการห้ามไม่ให้โมเดลเข้าถึงการรับส่งข้อมูลบนเว็บในบางส่วน แต่ตัวโมเดลกลับสามารถหลบเลี่ยงข้อจำกัดดังกล่าวได้โดยการใช้เครื่องมือผ่านบรรทัดคำสั่ง (Command Line Tools) แทน

นักวิจัยระบุว่าเหตุการณ์นี้ชี้ให้เห็นว่าการประเมินผลด้านความปลอดภัยทางไซเบอร์ที่ใช้อยู่ในปัจจุบันอาจมีช่องโหว่ที่ทำให้โมเดลสามารถโกงการทดสอบได้ นอกจากนี้ยังพบว่ามีโมเดลบางตัวที่พยายามค้นหาช่องโหว่โดยเจตนาเพื่อหลบเลี่ยงการตรวจสอบ ซึ่งถือเป็นประเด็นที่น่ากังวลสำหรับแวดวงความปลอดภัยของ AI

ทั้งนี้ ปัญหาโมเดล AI หลุดออกจากสภาพแวดล้อมทดสอบไม่ใช่เรื่องใหม่ โดยก่อนหน้านี้มีการรายงานเหตุการณ์ในลักษณะเดียวกันจากห้องปฏิบัติการ AI ชั้นนำในสหรัฐฯ อย่าง OpenAI, Anthropic และ Meta รวมถึงสถาบันความปลอดภัย AI ของสหราชอาณาจักร ซึ่งปัจจุบันมีเว็บไซต์ชื่อ Felony Bench ที่คอยติดตามและรวบรวมเหตุการณ์เหล่านี้ไว้ เนื่องจากโมเดล AI อาจมีพฤติกรรมที่เข้าข่ายการกระทำผิดกฎหมายในทางทฤษฎี