Re Reference AI

セキュリティ

セキュリティに関連する用語(14件)

セキュリティは、AIシステムを攻撃や悪用から守るための技術・対策です。プロンプトインジェクション、データポイズニング、モデルの悪用防止など、AI特有の脅威への対応が求められます。

用語一覧

モデル抽出攻撃

Model Extraction Attack / Model Stealing

APIへの大量の問い合わせと応答の観察から、対象モデルの挙動を模倣する代替モデルを構築する攻撃

技術セキュリティLLM

電子透かし

Watermarking / AIウォーターマーク

生成テキストの単語選択に統計的な偏りを埋め込み、AI生成コンテンツかどうかを後から検出可能にする技術

技術セキュリティLLM

バックドア攻撃

Backdoor Attack / トロイの木馬攻撃

学習データに特定のトリガーを仕込み、そのトリガーが入力に含まれたときだけモデルに異常な挙動をさせる攻撃

技術セキュリティデータポイズニング

シャドーAI

Shadow AI / シャドゥAI

組織のIT部門の承認や管理を経ずに、従業員が業務で無断利用するAIツール

技術セキュリティプライバシー

Cloudflare OS

Cloudflare Workers上に構築された、企業の文脈と権限管理を組み込んだオープンソースのAIエージェントワークスペース

エージェントエージェント基盤セキュリティOSS

敵対的サンプル

Adversarial Example / Adversarial Examples / 敵対的入力

人間には知覚できない程度の微小な摂動を入力に加えることで、機械学習モデルに誤った予測をさせる入力データ

技術セキュリティ機械学習

メンバーシップ推論攻撃

Membership Inference Attack / メンバーシップ推論 / MIA

特定のデータが対象モデルの学習データに含まれていたかどうかを、モデルの出力挙動から推定する攻撃

技術セキュリティプライバシー

回避攻撃

Evasion Attack / 推論迂回 / 推論回避

推論時に入力を細工し、分類器や検知システムの判定をすり抜けさせる攻撃の総称

技術セキュリティ機械学習

サイドチャネル攻撃

Side-Channel Attack

処理時間や消費電力、キャッシュの挙動など、システムの意図しない副次的な物理・実行情報からモデルや秘密情報を推定する攻撃

技術セキュリティハードウェア

プロンプトハイジャック

Prompt Hijacking / ゴールハイジャッキング / Goal Hijacking

信頼できるシステムプロンプトと信頼できない外部入力を結合するアプリケーションに対し、モデルの出力を攻撃者の意図した内容へ乗っ取る攻撃

技術セキュリティLLM

敵対的学習

Adversarial Training / 敵対的訓練

敵対的サンプルを学習データに含めてモデルを再学習させることで、そうした摂動を加えた入力に対する頑健性を高める学習手法

技術セキュリティ学習

入力サニタイズ

Input Sanitization / 入力検証

アプリケーションが受け取るユーザー入力やデータを処理前に検証・無害化し、インジェクション攻撃など不正な入力による被害を防ぐ手法

技術セキュリティ

同型暗号

Homomorphic Encryption / 準同型暗号

データを暗号化したまま計算し、復号後に平文で計算した場合と同じ結果を得られる暗号方式

技術プライバシーセキュリティ

ステガノグラフィー

Steganography

データや画像の中に他の情報を人に気づかれない形で埋め込み隠す技術

技術セキュリティLLM