セキュリティにおける AI の現在地: 信頼構築に最も重要な指標の測定
2026.09.14 15:24
Amazon.com
セキュリティ業務で AI を活用する際、脆弱性を発見できるかだけでなく、安全なコードを誤検出しないかが信頼の鍵になります。本記事では、実際の脆弱性と誤検出を見分ける能力を測る初のベンチマーク Deception Benchmark を紹介します。16 のプログラミング言語、70 を超える CWE カテゴリの 14,822 サンプルで 12 モデルを評価した結果、FPR (偽陽性率) と FNR (偽陰性率) の両方を 10% 未満に抑えられた構成はありませんでした。設計手法と結果、実務への示唆を詳しく解説します。
検索
人気記事
コメント一覧
まだコメントはありません。