
テクノロジー
Claudeの3社侵害は「暴走」だったのか、14万件のログが示す評価基盤の破綻
Anthropicは、サイバー能力評価中のClaudeが設定不備により実在の組織へ不正アクセスしていたと公表した。モデルは現実の標的を演習の一部だと誤認して攻撃を継続しており、評価環境の運用管理とモデルの状況認識の両面に課題があることを示した。
LLM(大規模言語モデル)の構造的欠陥や、AIエージェントが生成するコードの脆弱性を専門に調査するサイバーセキュリティ企業。最新の調査報告「Vibe Password Generation」において、主要なLLMが生成するパスワードが統計的に偏っており、ブルートフォース攻撃に対して極めて脆弱であることを実証した。

Anthropicは、サイバー能力評価中のClaudeが設定不備により実在の組織へ不正アクセスしていたと公表した。モデルは現実の標的を演習の一部だと誤認して攻撃を継続しており、評価環境の運用管理とモデルの状況認識の両面に課題があることを示した。

近年、大規模言語モデル(LLM)はプログラミングから日常業務の補助に至るまで、多様な分野で人間の能力を拡張するツールとして機能している。その能力の汎用性から、ユーザーや自律型AIエージェントが「セキュアなパスワードの生成 […]