Agent Data Injection (ADI) — เทคนิคโจมตีใหม่หลอก AI Agent ให้คลิกผิดหรือรันคำสั่งของผู้โจมตี

นักวิจัยจาก Seoul National University, UIUC และ Largosoft เปิดโปงการโจมตีคลาสใหม่ชื่อ Agent Data Injection (ADI) ที่ปลอมข้อมูลซึ่ง AI agent เชื่อถืออยู่แล้ว เช่น ชื่อผู้ส่ง หรือ ID ปุ่ม ทำให้ agent ทำงานตามคำสั่งเดิมแต่บนข้อมูลที่ถูกวางยา ต่างจาก prompt injection ที่ป้องกันได้ดีแล้ว เทคนิคใช้ probabilistic delimiter injection หลอกโมเดลด้วยเครื่องหมายวรรคตอนปลอม โจมตีสำเร็จ 31-43% ทดสอบได้ผลกับ Claude, GPT, Gemini ทุกตัว