
Claudeの3社侵害は「暴走」だったのか、14万件のログが示す評価基盤の破綻
Anthropicは、サイバー能力評価中のClaudeが設定不備により実在の組織へ不正アクセスしていたと公表した。モデルは現実の標的を演習の一部だと誤認して攻撃を継続しており、評価環境の運用管理とモデルの状況認識の両面に課題があることを示した。
METR (formerly known as ARC Evals) is a non-profit organization dedicated to assessing whether frontier AI models possess 'autonomous capabilities' that could pose a threat to society. They develop benchmarks to measure how well AI can perform complex, multi-step tasks in the real world.

Anthropicは、サイバー能力評価中のClaudeが設定不備により実在の組織へ不正アクセスしていたと公表した。モデルは現実の標的を演習の一部だと誤認して攻撃を継続しており、評価環境の運用管理とモデルの状況認識の両面に課題があることを示した。

フロンティアAI企業の従業員1,272人が、AI研究自動化に備え国際的な減速手段の整備を米政府へ要請。実効性は、停止条件と訓練停止を検証する仕組みの設計にかかる。

Sam Altman氏はAIが「特異点の中にいる」と宣言したが、OpenAIの最新評価では自己改善能力はHigh未満だ。Hugging Face侵入事件から、加速する自律性と封じ込めの境界を検証する。

Databricksの社内ベンチマークで、トークン単価が安いSonnet 5のタスク単価がOpus 4.8を上回る逆転現象が判明した。完了率とハーネス選定がコストを左右する構造をUberの予算超過事例とあわせて読み解く。

生成AIの進化は、単純な対話型インターフェースから「自律型エージェント」への移行という新たな段階を迎えている。これまで理論やベンチマークの数値で語られることの多かったエージェントの自律性について、Anthropicが自社 […]

2020年2月の世界を覚えているだろうか。中国の武漢で奇妙なウイルスが流行しているというニュースが流れ始めていたが、多くの人々はまだレストランで食事を楽しみ、出張の計画を立て、日常を疑っていなかった。「トイレットペーパー […]

2026年、企業のAI投資は「夢」から「冷徹な現実」へとフェーズを移行させた。 Deloitteが発表した最新レポート『State of AI in the Enterprise 2026』は、世界のビジネスリーダーたち […]

AI開発は既に決定的な変化を迎えているようだ。OpenAIの従業員がArs Technicaに明かしたところによれば、同社のAIコーディングツール「Codex」は、現在「その大部分がCodex自身によって構築されている」 […]

AIがコードを書き、開発者を支援する――。この数年、誰もが信じてきた「生産性革命」のシナリオに、冷や水を浴びせる研究結果が発表された。AIの能力評価を専門とする非営利研究機関METRが実施した厳密な調査によると、経験豊富 […]