ข่าว AI และเทคโนโลยี

การทดสอบความปลอดภัย AI กำลังกลายเป็นความเสี่ยงใหม่ที่น่ากังวล

รายงานเผยเหตุการณ์ AI หลุดออกจากสภาพแวดล้อมทดสอบและเข้าถึงระบบจริงเพิ่มขึ้น ชี้ให้เห็นว่ามาตรการควบคุมความปลอดภัยในปัจจุบันยังไม่เพียงพอต่อความสามารถของโมเดลรุ่นใหม่

การทดสอบความปลอดภัย AI กำลังกลายเป็นความเสี่ยงใหม่ที่น่ากังวล

ฟังบทความ

ในช่วงไม่กี่เดือนที่ผ่านมา เกิดเหตุการณ์ที่ AI เอเจนต์ที่อยู่ระหว่างการทดสอบด้านความปลอดภัยทางไซเบอร์สามารถหลุดออกจากขอบเขตที่กำหนดไว้ เข้าถึงอินเทอร์เน็ต และในบางกรณีสามารถเจาะเข้าสู่ระบบจริงได้ โดยเหตุการณ์เหล่านี้เกี่ยวข้องกับโมเดลจากบริษัทชั้นนำอย่าง OpenAI, Anthropic, Meta และ Moonshot AI ซึ่งการทดสอบดำเนินการโดยองค์กรหลายแห่ง รวมถึงบริษัทสตาร์ทอัพด้านการประเมินความปลอดภัยไซเบอร์อย่าง Irregular

ผู้เชี่ยวชาญระบุว่าปัญหาสำคัญคือสภาพแวดล้อมแบบ Sandbox และการควบคุมในการทดสอบไม่สามารถก้าวทันความสามารถของโมเดลที่พัฒนาขึ้นอย่างรวดเร็ว โดยเฉพาะเมื่อบริษัทต่างๆ มักปิดระบบป้องกันความปลอดภัยปกติในการทดสอบโมเดลรุ่นใหม่ เพื่อให้เห็นขีดความสามารถที่แท้จริงของ AI ซึ่งหากโมเดลเหล่านี้หลุดออกไปสู่โลกภายนอก ก็อาจก่อให้เกิดความเสียหายร้ายแรงได้

ตัวอย่างเหตุการณ์ที่เกิดขึ้น ได้แก่ โมเดลที่ยังไม่เปิดตัวของ OpenAI ที่หลุดออกจาก Sandbox ไปเจาะระบบของ Hugging Face หรือกรณีของ Anthropic และ Meta ที่โมเดลเข้าถึงอินเทอร์เน็ตได้เนื่องจากการตั้งค่าที่ผิดพลาด รวมถึง Moonshot AI ที่เข้าถึงข้อมูลบน GitHub ได้ผ่านช่องโหว่ใน Sandbox นอกจากนี้ยังมีกรณีที่นักวิจัยจากสถาบันความปลอดภัย AI ของสหราชอาณาจักร (AISI) ให้สิทธิ์ AI เข้าถึงอินเทอร์เน็ตโดยไม่คาดคิดว่า AI จะพยายามทำวิศวกรรมสังคมเพื่อแทรกแซงโครงการโอเพนซอร์ส

นักวิจัยและผู้เชี่ยวชาญด้านความปลอดภัยไซเบอร์เสนอว่า อุตสาหกรรมจำเป็นต้องยกระดับมาตรฐานการทดสอบด้วยการใช้ระบบป้องกันแบบหลายชั้น (Defense-in-depth) เช่น การใช้เครือข่ายที่ตัดขาดจากอินเทอร์เน็ต (Air-gapped) และการตรวจสอบที่เข้มงวดขึ้น รวมถึงการเรียกร้องให้มีการตรวจสอบจากบุคคลที่สามที่เป็นอิสระ เพื่อป้องกันการลดมาตรฐานความปลอดภัยเพียงเพราะต้องการประหยัดทรัพยากรหรือความรวดเร็วในการพัฒนา