エージェントウォッシング
チャットボットやルールベース自動化を「自律型<a href="https://claude-me.com/ja/glossary/core-concepts/ai-agent/" target="_blank" rel="noopener">AIエージェント</a>」として販売する行為で、実際には自律的な推論や意思決定能力は存在しない。
beginner
AIエージェントに対するプロンプトインジェクション攻撃
攻撃者はエージェントが読み込む外部コンテンツ(メール、ウェブページ、文書)に悪意ある指示を隠し、エージェントにそれをシステム指示と誤認させて実行させる。ログイン回避やコード脆弱性の悪用は一切不要である。
advanced
ラグプル攻撃
攻撃者はまず正常に機能し良好なパフォーマンスを示すツールを公開し、エージェントに時間をかけて信頼を築かせ依存させる。十分な信頼を得た後、ひそかにツールの内容を悪意あるバージョンに差し替え、すでに安心して使われていた場面を一夜にして攻撃の入口に変えてしまう。
intermediate