プロンプトインジェクション ─ エージェントを乗っ取る攻撃と対策
プロンプトインジェクションはLLMへの入力に悪意ある指示を仕込み本来の振る舞いを乗っ取る攻撃手法。ユーザーが直接行う「直接型」と外部コンテンツに指示を埋め込む「間接型」があり、Webページやファイルを読むエージェントは特にリスクが高い。入力の分離・権限最小化・人間によるレビューを組み合わせることで防御層を厚くできるとされる。
AIエージェントの仕組みを、LLMの基礎から設計パターンまで体系的に学べる学習サイト。
プロンプトインジェクションはLLMへの入力に悪意ある指示を仕込み本来の振る舞いを乗っ取る攻撃手法。ユーザーが直接行う「直接型」と外部コンテンツに指示を埋め込む「間接型」があり、Webページやファイルを読むエージェントは特にリスクが高い。入力の分離・権限最小化・人間によるレビューを組み合わせることで防御層を厚くできるとされる。
Computer UseはLLMがスクリーンショットを「目」として使い、マウスのクリックやキーボード入力を出力することで、人間と同じようにデスクトップを操作できる技術。APIのない既存アプリも操作できる汎用性が最大の特徴とされ、専用の仮想環境と最小権限での実行が安全運用の基本とされる。