STING

攻撃者がAIエージェントに規則違反を誘導する手法を解明(How attackers persuade AI agents to break the rules) 1602ソフトウェア工学

攻撃者がAIエージェントに規則違反を誘導する手法を解明(How attackers persuade AI agents to break the rules)

2026-08-19 スイス連邦工科大学ローザンヌ校(EPFL)EPFL(スイス連邦工科大学ローザンヌ校)の研究チームは、AIエージェントが単一の悪意ある指示ではなく、複数回の一見無害な対話を通じて誘導されるリスクを体系的に検証する自動テス...
ad
タイトルとURLをコピーしました