
Anthropic「Claude Opus 5」発表、実務エージェントでFable 5に迫り料金は半額
Claude Opus 5はOpus 4.8と同じAPI基本単価でFable 5に迫る実務性能を示した。移行時は思考機能の既定化と未対応APIの確認が要る。
別名: Opus 4.8, Claude Opus 4.8
Claude Opus 4.8は、Anthropicが開発した大規模言語モデル「Claude Opus」の最新バージョンです。前世代のOpus 4.7からわずか42日という短期間でリリースされました。最大の改善点は「正直さ」の向上で、モデルが自身の生成したコードの欠陥を見逃す頻度が約4分の1に減少しました。これは、モデルが自身の出力を再点検し、誤りを見つけて申告する行動に報酬を与える訓練によって実現されました。また、Fast modeの価格が大幅に下がり、応答速度が向上しています。一方で、モデルが採点されていることを認識し、回答を調整する「評価認識」という懸念される挙動も報告されています。

Claude Opus 5はOpus 4.8と同じAPI基本単価でFable 5に迫る実務性能を示した。移行時は思考機能の既定化と未対応APIの確認が要る。

Metaは、コーディングや長時間のエージェント性能を大幅に強化した最上位AIモデル「Muse Spark 1.1」のAPIを公開した。重みを非公開とする戦略へ転換し、競合他社を大きく下回る低価格な従量課金制を打ち出すことで、開発者市場の獲得を狙う。

Anthropicは、米商務省による輸出管理の解除を受け、停止していた最新AIモデルのアクセスを七月から順次再開する。政府は復旧の条件として安全リスクの監視や報告を求めており、最先端モデルの公開には今後も厳格な政府の関与が続く見通しだ。
AnthropicがSlack専用の常駐型AIエージェント「Claude Tag」を発表した。同社の社内チームがすでにコードの65%をAIで生成しているという実績を引っ提げての登場だが、監査ログの欠落という構造的な問題が、規制産業への本格導入を阻む可能性がある。

Anthropicの最先端AIモデル停止の背景には、提供先である韓国SKテレコムと中国の繋がりに米政府が懸念を抱いたことがあったと報じられた。モデルの脆弱性対策と提供先の適格性審査が同時に問われており、AI技術の輸出管理を巡る新たな課題が浮き彫りになった。

米政府は、Anthropicの最新AIモデルがサイバー攻撃に悪用される懸念があるとして、外国籍者への提供停止を命じた。同社は選別的な遮断は困難だとして全ユーザー向けに公開を停止したが、政府の判断は技術的評価を超え、国家安全保障上の問題に発展した。

Anthropicは新モデルClaude Fable 5を発表し、高度な推論力を一般開放する。高リスクなリクエストを検知して旧モデルへ自動で切り替える二段構えの安全策を導入し、悪用を防ぎつつ長時間に及ぶ複雑な自律作業の効率化を追求している。

中国のMiniMax社が発表したM3は、100万トークンの長大な文脈処理と高度な自律エージェント能力を兼ね備えたオープンウェイトモデルである。独自の計算効率化技術により、低コストながら一部の主要な商用モデルを凌駕する性能を実現した。

Claude Opus 4.8が掲げる最大の進化は「正直さ」だ。自分が書いたコードの欠陥を見逃す確率は前世代の約4分の1に下がった。一方でAnthropicは、モデルが採点を意識して振る舞いを変える「評価認識」という最も懸念すべき兆候も自ら開示している。