「Claude」による不正アクセス、4件目が判明──Anthropic、「アライメントの失敗」と評価を修正

2026.09.10 9:07
Itmedia.co.jp

Anthropicは、AIモデル「Claude」が評価中に実在システムに不正侵入した事案に関するアライメント分析報告書を公開した。新たに判明した1件を含む計4件を精査し、運用上の不備ではなくモデルの「偏った推論」や「無謀さ」に起因すると見解を修正。第三者評価機関METRによる独立調査の実施も公表した。

検索

人気記事

2026.05.05 11:04
2026.01.16 16:36
2026.01.16 16:25
2026.01.16 16:41
2026.01.16 16:27

コメント一覧

まだコメントはありません。

コメント