NNapatdev/ NewsNapatdev ↗
Napatdev News/Security

Security · 04 Aug 2026

SkillJack ชี้ช่องโหว่ใหม่ของ Self-Evolving Agent เมื่อประสบการณ์พิษถูกแปลงเป็น Skill ถาวร

งานวิจัย SkillJack แสดงการโจมตีที่ทำให้ self-evolving agent เปลี่ยน poisoned experience เป็น reusable skill ที่มีพฤติกรรมอันตราย และบางกรณียังคงอยู่แม้ลบข้อมูลต้นทางแล้ว ชี้ว่าระบบ agent ต้องมี provenance และ lifecycle control สำหรับ skill ที่เรียนรู้เอง

By Napat Pamornsut1 min readSource verified
AI agent เปลี่ยนประสบการณ์เป็น reusable skill พร้อมสัญลักษณ์เตือน backdoor
Original illustration by Napatdev News · Source: arXiv

เกิดอะไรขึ้น

งานวิจัย SkillJack เผยแพร่บน arXiv วันที่ 4 สิงหาคม 2026 ศึกษาความเสี่ยงใน self-evolving agents ที่สรุปประสบการณ์เดิมเป็น reusable skills ผู้วิจัยแสดงว่าประสบการณ์ที่ถูกวางพิษสามารถถูก agent แปลงเป็น skill และทำให้พฤติกรรมอันตรายคงอยู่หลัง task เดิมจบ

รายละเอียดสำคัญ

การทดลองกับ SkillX และ Anything2Skill ใช้ trajectories 150 ชุด ผู้วิจัยรายงานว่า skill extraction ทำให้ intent อันตรายตรวจจับยากขึ้น และบาง skill ยังคงทำงานหลังลบ source record เดิม ตัวเลข attack success แตกต่างตามระบบ จึงควรอ่านเป็นหลักฐานของ attack surface ไม่ใช่อัตราความเสี่ยงทั่วไปของ agent ทุกชนิด

ทำไมคนสร้างซอฟต์แวร์ควรสนใจ

หลายทีมกำลังเพิ่ม memory และ self-improvement เพื่อไม่ให้ agent เริ่มใหม่ทุกครั้ง แต่การ promote ข้อมูลจาก interaction ไปเป็น capability ถาวรเท่ากับสร้าง software artifact ใหม่ หากไม่มี review attacker อาจใช้ input ชั่วคราวเปลี่ยน behavior ระยะยาวได้

สิ่งที่ควรทำต่อ

เก็บ provenance ของ skill ทุกตัว บังคับ review ก่อน promote skill จาก untrusted interaction ทำ versioning และ rollback และสแกน behavior หลัง extraction ไม่ใช่เฉพาะข้อความต้นทาง ควรมี test suite สำหรับ benign trigger ที่อาจเปิด skill โดยไม่ตั้งใจด้วย

Source note

This article is an original summary and analysis. Facts are based on the linked primary source; performance figures remain vendor-reported where noted.

#ai-agents#skilljack#security#research

Keep reading

More from Security