プロンプトインジェクション対策
英 Prompt Injection Defense
生成AIに対する悪意ある不正指示を検知・遮断し、システムの誤作動や社内情報の不正漏洩を防ぐ防御技術。
【定義】
生成AIシステムに対し、第三者が悪意のある指示を入力して制限を回避したり内部データを不正抽出させたりする攻撃を防ぐ技術です。
【概要】
AIを社内データベースや自動業務フローに組み込む際、入力テキストの検証(サニタイズ)やシステムプロンプトの厳格化、出力制御を行い、AIの誤作動や情報漏洩を防御します。
【実務でのポイント】
社内生成AIツールや対話型Botを自社構築(RAG等)するクライアントに対し、セキュリティリスクとガバナンス基準をクリアした安全なAI導入コンサルティングを提供する際の必須知識です。