イントロ
AIのセキュリティ・プライバシーとプロンプト脅威
入力、モデル、ツール、出力、ログの各境界を守る
利用者入力や外部文書に含まれる命令が、本来の指示や安全方針を上書きし、意図しない情報開示や行動を誘う攻撃です。
上下にスクロールするかキーボードの上下キーを使うと、次の学習カードへ進めます。
入力、モデル、ツール、出力、ログの各境界を守る
利用者入力や外部文書に含まれる命令が、本来の指示や安全方針を上書きし、意図しない情報開示や行動を誘う攻撃です。
信頼できる指示、利用者入力、取得文書、ツール出力を区別する。
とで、秘密と高権限操作をモデル文脈から分離する。
とを行い、を経路ごとに置く。
とで、機密情報やを検査する。
だけへ依存せず、操作と判断をへ残します。異常時はし、秘密を渡さない、ツールの書き込みを承認制にするなどモデル外の制御を置きます。
入力と取得データを命令から分離
秘密・権限・ツールをモデル外で制御
出力検証・監査・停止を設計
プロンプトインジェクションの影響を抑える最も適切な設計はどれですか。
AIにも通常のアプリ・基盤セキュリティが必要
プロンプト脅威は直接・間接入力から来る
秘密・ツール権限・出力をモデル外でも制御
監査ログの内容と保持も保護する
今の内容と近いトピックを並べて、学習範囲を広げやすくしています。