
AIが数学を解けて雑談で詰まる理由は、欠陥ではなく設計の必然だった
Claude Opus 4.6はSWE-bench Verifiedで80.8%のスコアを記録し、プロのエンジニアが数時間かけて解くGitHub上の実際のバグ修正を自動で解決できるレベルに達している。数学オリンピック問題 […]

Claude Opus 4.6はSWE-bench Verifiedで80.8%のスコアを記録し、プロのエンジニアが数時間かけて解くGitHub上の実際のバグ修正を自動で解決できるレベルに達している。数学オリンピック問題 […]

Claude APIに、エージェントが判断に詰まった瞬間だけ上位モデルへ相談できる仕組みが加わった。2026年4月9日にベータ公開された「アドバイザーツール(advisor_20260301)」は、HaikuやSonne […]

2026年4月8日、二つの連邦裁判所が同じ事案に正反対の判断を下した。ワシントンD.C.連邦控訴裁判所はAnthropicのブラックリスト指定差し止め請求を却下し、国家安全保障上の利益を優先した。だが同日、サンフランシス […]

Anthropicは2026年4月8日(現地時間)、クラウド上で長時間動作するAIエージェント向けの新サービス「Claude Managed Agents」を公開ベータとして開始した。Claude Platform上で利 […]

AIが27年前のOSバグを発見し、16年前に埋もれていた脆弱性を掘り起こす。Anthropicが2026年4月7日に発表したClaude Mythos Previewは、そのサイバーセキュリティ能力が突出しすぎているがゆ […]

GitHub Copilot CLIに2026年4月6日、「Rubber Duck」と名付けられた実験的機能が追加された。コーディングタスクを実行するAIモデルとは別ファミリーのモデルを呼び出し、成果物を批評的にレビュー […]

AI企業が計算資源を争う2026年、Anthropicは$210億相当のTPU(Tensor Processing Unit、AI処理専用半導体)チップを確保するため、GoogleとBroadcomとの大型提携を締結した […]

現在のAIモデルの性能評価システムは、長らく一つの絶対的な前提の上で運用されてきた。それは、あらゆる入力データに対して何らかの「単一の正解(Ground truth)」が存在するという仮説である。多くの機械学習の研究開発 […]

Anthropicが、Claudeのサブスクリプションを第三者製ツールから使う経路に新たな制限をかける。ユーザー向けメールとClaude Code責任者Boris Cherny氏のX投稿によれば、米太平洋時間2026年4 […]

Anthropicは2026年4月2日、Claude Sonnet 4.5の内部構造を解析した論文「Emotion Concepts and their Function in a Large Language Mode […]

2026年3月31日、AI開発企業Anthropicが提供するCLIベースのコーディング支援ツール「Claude Code」のソースコード全容が、オープンなnpmレジストリを通じて誰にでもアクセス可能な状態になっていたこ […]

Anthropicが提供するコーディング支援ツール「Claude Code」のCLI(コマンドラインインターフェース)版に、大幅な機能追加が実施された。macOS上で動作するバージョン2.1.85以降において、Anthr […]