セキュリティ
セキュリティに関連する用語(14件)
セキュリティは、AIシステムを攻撃や悪用から守るための技術・対策です。プロンプトインジェクション、データポイズニング、モデルの悪用防止など、AI特有の脅威への対応が求められます。
用語一覧
モデル抽出攻撃
Model Extraction Attack / Model Stealing
APIへの大量の問い合わせと応答の観察から、対象モデルの挙動を模倣する代替モデルを構築する攻撃
電子透かし
Watermarking / AIウォーターマーク
生成テキストの単語選択に統計的な偏りを埋め込み、AI生成コンテンツかどうかを後から検出可能にする技術
バックドア攻撃
Backdoor Attack / トロイの木馬攻撃
学習データに特定のトリガーを仕込み、そのトリガーが入力に含まれたときだけモデルに異常な挙動をさせる攻撃
シャドーAI
Shadow AI / シャドゥAI
組織のIT部門の承認や管理を経ずに、従業員が業務で無断利用するAIツール
Cloudflare OS
Cloudflare Workers上に構築された、企業の文脈と権限管理を組み込んだオープンソースのAIエージェントワークスペース
敵対的サンプル
Adversarial Example / Adversarial Examples / 敵対的入力
人間には知覚できない程度の微小な摂動を入力に加えることで、機械学習モデルに誤った予測をさせる入力データ
メンバーシップ推論攻撃
Membership Inference Attack / メンバーシップ推論 / MIA
特定のデータが対象モデルの学習データに含まれていたかどうかを、モデルの出力挙動から推定する攻撃
回避攻撃
Evasion Attack / 推論迂回 / 推論回避
推論時に入力を細工し、分類器や検知システムの判定をすり抜けさせる攻撃の総称
サイドチャネル攻撃
Side-Channel Attack
処理時間や消費電力、キャッシュの挙動など、システムの意図しない副次的な物理・実行情報からモデルや秘密情報を推定する攻撃
プロンプトハイジャック
Prompt Hijacking / ゴールハイジャッキング / Goal Hijacking
信頼できるシステムプロンプトと信頼できない外部入力を結合するアプリケーションに対し、モデルの出力を攻撃者の意図した内容へ乗っ取る攻撃
敵対的学習
Adversarial Training / 敵対的訓練
敵対的サンプルを学習データに含めてモデルを再学習させることで、そうした摂動を加えた入力に対する頑健性を高める学習手法
入力サニタイズ
Input Sanitization / 入力検証
アプリケーションが受け取るユーザー入力やデータを処理前に検証・無害化し、インジェクション攻撃など不正な入力による被害を防ぐ手法
同型暗号
Homomorphic Encryption / 準同型暗号
データを暗号化したまま計算し、復号後に平文で計算した場合と同じ結果を得られる暗号方式
ステガノグラフィー
Steganography
データや画像の中に他の情報を人に気づかれない形で埋め込み隠す技術