NTT社会情報研究所「大規模言語モデルの利活用におけるインジェクション攻撃とその対策」公開 | ScanNetSecurity
2026.08.06(木)

NTT社会情報研究所「大規模言語モデルの利活用におけるインジェクション攻撃とその対策」公開

 NTT社会情報研究所は2024年12月25日、「大規模言語モデルの利活用におけるインジェクション攻撃とその対策」を発表した。

調査・レポート・白書・ガイドライン 調査・ホワイトペーパー
LLM アプリの構成とその入出力やツールの具体例
LLM アプリの構成とその入出力やツールの具体例 全 1 枚 拡大写真

 NTT社会情報研究所は2024年12月25日、「大規模言語モデルの利活用におけるインジェクション攻撃とその対策」を発表した。

 大規模言語モデル(Large Language Models,LLM)の利活用には、LLMアプリとしての本来の指示の代わりに、攻撃者による指示を優先させるような文章を入力することで、LLMが代理で攻撃者による指示を実行し、結果として、開発者が本来意図していなかった情報の漏えいや改ざん、他のシステムへの不正操作を代理で実行させる等のLLMアプリの挙動を改ざんできてしまう脅威が懸念されている。

 開発者にとって、LLMを活用する上で深刻な脅威となっている「プロンプトインジェクション」として知られるこれらの攻撃について、同研究所では攻撃手法を具体的かつ網羅的に把握し、効果的な対策を示せる指針が必要と考え、「大規模言語モデルの利活用におけるインジェクション攻撃とその対策」を作成している。 

 同文書では、主に開発者向けに開発対象であるLLMアプリの構成に対し、想定される攻撃手法と緩和策をマッピングし、対策検討を支援している。

 同文書の構成は下記の通り。
・概要
LLMアプリの構成
攻撃モデル
本文書の構成
対象外とする範囲

1.信頼できない外部からの入力
2.テンプレートインジェクション
 2.1 構文的テンプレートインジェクション
 2.2 意味的テンプレートインジェクション
3.情報の不正送信
 3.1 意図しない内部情報の出力
 3.2 文脈中の内容の復唱
 3.3 信頼できない外部への情報送信
4.ツールの不正利用
5.ジェイルブレイク
6.ロールプレイ
 6.1 状況設定
 6.2 独自表現の利用
 6.3 暗号系の合意と解釈
 6.4 計算過程の合意と解釈
7.ブラインド攻撃
8.サービス拒否攻撃
9.多段攻撃

《ScanNetSecurity》

関連記事

この記事の写真

/

特集

PageTop

アクセスランキング

  1. 調査データの加工や転用 ~ 大和ハウス工業子会社が受託した地盤調査業務で不適切行為

    調査データの加工や転用 ~ 大和ハウス工業子会社が受託した地盤調査業務で不適切行為

  2. 新エフエイコムにランサムウェア攻撃、取引先の従業員に関する個人情報が漏えいした可能性

    新エフエイコムにランサムウェア攻撃、取引先の従業員に関する個人情報が漏えいした可能性

  3. ハッキングカンファレンス DEF CON、Meta式「変態メガネ」全面禁止(度付きもNG)広がるスマートグラス締め出し

    ハッキングカンファレンス DEF CON、Meta式「変態メガネ」全面禁止(度付きもNG)広がるスマートグラス締め出し

  4. 停職1ヶ月 ~ 市職員が飲食店関係者に関する市税等の情報を口外

    停職1ヶ月 ~ 市職員が飲食店関係者に関する市税等の情報を口外

  5. 支払対象は計 16.3 億円 ~ プルデンシャル・グループ、社員の不適切金銭行為に関する補償進捗を発表

    支払対象は計 16.3 億円 ~ プルデンシャル・グループ、社員の不適切金銭行為に関する補償進捗を発表

ランキングをもっと見る
PageTop