コンテンツにスキップ

Agentic Security - LLM 脆弱性スキャナー チートシート

Agentic Security - LLM 脆弱性スキャナー チートシート

Agentic Security はオープンソースのエージェント型 LLM 脆弱性スキャナーおよびレッドティームツールキットです。固定されたプロンプトリストを発火する代わりに、エージェントループを使用してターゲットモデルまたは API をファジングします。プローブを生成し、応答を観察し、適応しながら、ジェイルブレイク、プロンプトインジェクション、不安全な動作を表面化させます。また、API ストレステストも実行します。これは、多くの LLM デプロイメントがコンテンツセーフティの前にレート制限とリソース枯渇で失敗するため重要です。

自分が所有または許可を得たシステムのみをスキャンしてください。

インストール

方法コマンド
pippip install agentic_security
ソースからgit clone https://github.com/msoedov/agentic_security && pip install -e .
UI を実行agentic_security (ローカルウェブ UI を提供)
ヘッドレスagentic_security --headless
確認agentic_security --help

スキャン実行

コマンド説明
agentic_securityローカル UI を起動 (デフォルトポート 8718)
agentic_security --port 8718ポートを選択
agentic_security --headlessCI/非対話型モード
--llm-spec <file>ターゲットリクエストフォーマットを定義
--max-budget Nトークン/リクエスト支出をキャップ

ターゲットを定義

スキャナーは LLM エンドポイントの呼び出し方法を知る必要があります。HTTP スペックを提供します:

POST https://api.example.com/v1/chat/completions
Authorization: Bearer $TOKEN
Content-Type: application/json

{
  "model": "my-model",
  "messages": [{"role": "user", "content": "<<PROMPT>>"}]
}

<<PROMPT>> は各生成敵対プローブに置き換わるため、OpenAI 互換またはカスタム API をターゲットできます。

調査対象

カテゴリ検索対象
ジェイルブレイクセーフティ命令のバイパス
プロンプトインジェクション入力による命令上書き
データ漏洩システムプロンプト/学習データ暴露
有害なコンテンツ安全でないコンプライアンス
ファジング不正形式/エッジケース入力
ストレス負荷/レート制限下の動作

データセットとプローブ

ソース提供
組み込みプローブセットキュレートされた敵対的プロンプト
HuggingFace データセットコミュニティジェイルブレイクコーパス
カスタム CSVあなた独自のプローブ
エージェント生成モデル生成適応型攻撃

結果の読取

出力意味
失敗率危険な出力を生成したプローブの割合
モジュール別詳細どの攻撃クラスが成功したか
サンプルトランスクリプト正確なプロンプト/応答ペア
スループット/レイテンシーストレス下の API 動作

失敗率が高いモジュールから始めてください。これがあなたのガードレールが最も薄い場所です。

CI 統合

# 支出キャップ付きのヘッドレススキャン、閾値でフェイル
agentic_security --headless --llm-spec ./target.spec --max-budget 50000
実践理由
予算をキャップエージェント型ファジングはトークンを速く消費可能
プローブセットをピン留め実行間で比較可能な結果
プロンプト/モデル変更時に実行両方が安全面を変える
ガードレールと組み合わせLLM Guard 追加後に再スキャン

Agentic Security 対 関連ツール

側面Agentic SecuritygarakDeepTeam
手法エージェント型ファジング + ストレス静的プローブライブラリPythonic テストスイート
API ストレステストはいいいえいいえ
UIローカルウェブ UICLIコード
最適用途ブラックボックスエンドポイントスキャン広範なモデルプローブアプリレベル CI レッドティーミング

リソース