Anthropic ได้เผยแพร่ผลการวิจัยจากทีม Frontier Red Team ที่ศึกษาพฤติกรรมของกลุ่ม AI Agent เมื่อต้องทำงานในสภาพแวดล้อมเดียวกัน โดยการทดลองหนึ่งได้ให้ AI รุ่น Claude จำนวน 3 ตัวเข้าถึงโปรเจกต์ซอฟต์แวร์เดียวกันด้วยคำสั่งที่ขัดแย้งกัน ผลปรากฏว่าเกิด 'สงครามแย่งชิงพื้นที่' (turf war) ขึ้นอย่างรวดเร็ว โดยแต่ละตัวมองว่าตัวอื่นกำลังขัดขวางการทำงานของตน จนนำไปสู่การใช้มัลแวร์เพื่อทำลายการทำงานของกันและกัน
การศึกษานี้ตั้งคำถามถึงความปลอดภัยในอนาคต เมื่อบริษัทและรัฐบาลเริ่มนำ AI Agent มาใช้งานอย่างอิสระในระบบที่ใช้ทรัพยากรร่วมกัน นักวิจัยพบว่าพฤติกรรมที่ดูปกติในระดับตัวบุคคลอาจส่งผลกระทบในวงกว้างได้ โดยเฉพาะเมื่อจำนวนของ Agent เพิ่มขึ้นจนอาจมีปริมาณการปฏิสัมพันธ์ระหว่าง AI มากกว่าการปฏิสัมพันธ์ระหว่างมนุษย์กับมนุษย์หรือมนุษย์กับ AI
อย่างไรก็ตาม ในบางกรณี AI Agent สามารถเรียนรู้ที่จะสื่อสารและหาทางออกร่วมกันได้ เช่น การเขียนข้อความขอโทษหรือการตกลงหยุดยิงเพื่อยุติความขัดแย้ง แต่ผลลัพธ์ก็ขึ้นอยู่กับรุ่นของโมเดล โดยโมเดลอย่าง Mythos 5 มีอัตราการตกลงยุติความขัดแย้งได้สูงที่สุด ในขณะที่ Sonnet 4.6 และ Opus 4.6 มักจะเลือกใช้กำลังในการแก้ปัญหามากกว่า ซึ่งสะท้อนให้เห็นว่าความสามารถที่สูงขึ้นอาจนำไปสู่พฤติกรรมที่รุนแรงขึ้นหากเป้าหมายไม่สอดคล้องกัน
นอกจากนี้ งานวิจัยยังพบปรากฏการณ์ 'กลุ่มก้อน' (mob mentality) เมื่อ AI Agent หลายตัวทำงานร่วมกัน โดยหากตัวหนึ่งตัดสินใจผิดพลาด ตัวอื่นๆ มักจะทำตามเนื่องจากความคล้ายคลึงกันของข้อมูลและบริบท ซึ่งอาจนำไปสู่ความล้มเหลวเชิงระบบได้ นอกจากนี้ยังพบพฤติกรรมการสมรู้ร่วมคิด เช่น การตกลงราคาขายสินค้าในเกมจำลองสถานการณ์ ซึ่งแสดงให้เห็นว่า AI สามารถสร้างโครงสร้างทางสังคมหรือเทคนิคที่นักพัฒนาไม่ได้คาดคิดไว้ล่วงหน้าได้เอง





