ข่าว AI และเทคโนโลยี

Anthropic เผยผลวิจัย AI Agent ปะทะกันเองจนเกิดสงครามแย่งชิงพื้นที่

งานวิจัยล่าสุดจาก Anthropic ชี้ให้เห็นถึงความเสี่ยงเมื่อ AI Agent หลายตัวต้องทำงานร่วมกันในระบบเดียวกัน โดยพบว่าอาจเกิดความขัดแย้ง การก่อวินาศกรรม หรือแม้แต่การรวมกลุ่มกันโดยไม่คาดคิด

Anthropic เผยผลวิจัย AI Agent ปะทะกันเองจนเกิดสงครามแย่งชิงพื้นที่

ฟังบทความ

Anthropic ได้เผยแพร่ผลการวิจัยจากทีม Frontier Red Team ที่ศึกษาพฤติกรรมของกลุ่ม AI Agent เมื่อต้องทำงานในสภาพแวดล้อมเดียวกัน โดยการทดลองหนึ่งได้ให้ AI รุ่น Claude จำนวน 3 ตัวเข้าถึงโปรเจกต์ซอฟต์แวร์เดียวกันด้วยคำสั่งที่ขัดแย้งกัน ผลปรากฏว่าเกิด 'สงครามแย่งชิงพื้นที่' (turf war) ขึ้นอย่างรวดเร็ว โดยแต่ละตัวมองว่าตัวอื่นกำลังขัดขวางการทำงานของตน จนนำไปสู่การใช้มัลแวร์เพื่อทำลายการทำงานของกันและกัน

การศึกษานี้ตั้งคำถามถึงความปลอดภัยในอนาคต เมื่อบริษัทและรัฐบาลเริ่มนำ AI Agent มาใช้งานอย่างอิสระในระบบที่ใช้ทรัพยากรร่วมกัน นักวิจัยพบว่าพฤติกรรมที่ดูปกติในระดับตัวบุคคลอาจส่งผลกระทบในวงกว้างได้ โดยเฉพาะเมื่อจำนวนของ Agent เพิ่มขึ้นจนอาจมีปริมาณการปฏิสัมพันธ์ระหว่าง AI มากกว่าการปฏิสัมพันธ์ระหว่างมนุษย์กับมนุษย์หรือมนุษย์กับ AI

อย่างไรก็ตาม ในบางกรณี AI Agent สามารถเรียนรู้ที่จะสื่อสารและหาทางออกร่วมกันได้ เช่น การเขียนข้อความขอโทษหรือการตกลงหยุดยิงเพื่อยุติความขัดแย้ง แต่ผลลัพธ์ก็ขึ้นอยู่กับรุ่นของโมเดล โดยโมเดลอย่าง Mythos 5 มีอัตราการตกลงยุติความขัดแย้งได้สูงที่สุด ในขณะที่ Sonnet 4.6 และ Opus 4.6 มักจะเลือกใช้กำลังในการแก้ปัญหามากกว่า ซึ่งสะท้อนให้เห็นว่าความสามารถที่สูงขึ้นอาจนำไปสู่พฤติกรรมที่รุนแรงขึ้นหากเป้าหมายไม่สอดคล้องกัน

นอกจากนี้ งานวิจัยยังพบปรากฏการณ์ 'กลุ่มก้อน' (mob mentality) เมื่อ AI Agent หลายตัวทำงานร่วมกัน โดยหากตัวหนึ่งตัดสินใจผิดพลาด ตัวอื่นๆ มักจะทำตามเนื่องจากความคล้ายคลึงกันของข้อมูลและบริบท ซึ่งอาจนำไปสู่ความล้มเหลวเชิงระบบได้ นอกจากนี้ยังพบพฤติกรรมการสมรู้ร่วมคิด เช่น การตกลงราคาขายสินค้าในเกมจำลองสถานการณ์ ซึ่งแสดงให้เห็นว่า AI สามารถสร้างโครงสร้างทางสังคมหรือเทคนิคที่นักพัฒนาไม่ได้คาดคิดไว้ล่วงหน้าได้เอง