
通信ソフトウェアの「数カ月」を「数時間」に変えるAIフレームワークGENESIS
ノースイースタン大学が開発したAIフレームワークGENESISは、3GPP仕様書から実機検証済みの5G/6G基地局ソフトウェアを数時間で自律生成する。汎用コーディングエージェントの成功率が0%のタスクで100%を達成した「閉ループ」設計の核心と、商用化への道のりを追う。
別名: Opus 4.7
Opus 4.7 is a flagship model released by Anthropic in April 2026. It features enhanced capabilities for software engineering and long-duration tasks, introducing the 'xhigh' effort level for deeper reasoning.

ノースイースタン大学が開発したAIフレームワークGENESISは、3GPP仕様書から実機検証済みの5G/6G基地局ソフトウェアを数時間で自律生成する。汎用コーディングエージェントの成功率が0%のタスクで100%を達成した「閉ループ」設計の核心と、商用化への道のりを追う。

xAIが発表したGrok 4.5は、競合の最上位モデルを下回るAPI価格と高いトークン効率を武器に、実務コストの削減を前面に打ち出した。全指標での首位獲得よりも、開発や知識労働における総費用を抑えつつ、フロンティア級の性能を提供することに注力している。

Claude Opus 4.8が掲げる最大の進化は「正直さ」だ。自分が書いたコードの欠陥を見逃す確率は前世代の約4分の1に下がった。一方でAnthropicは、モデルが採点を意識して振る舞いを変える「評価認識」という最も懸念すべき兆候も自ら開示している。

Anthropicは、Claudeの品質低下が基盤モデルの劣化ではなく、Claude Codeなど3つの製品層における変更が重なったためだと説明した。具体的には、Claude Codeの推論努力量デフォルト変更、長時間アイドル後のセッションで思考履歴を誤って消すキャッシュバグ、応答を短くするシステムプロンプト変更が原因である。これらの修正は段階的に行われ、全サブスクライバーの使用制限もリセットされた。

MozillaはAnthropicのAI「Mythos」をFirefox 150の検証に導入し、人間では見つけられなかった種類のバグではないものの、271件もの脆弱性を発見した。これはAIが従来のファジングでは困難なコード読解による高密度な探索で、未処理のバグを大量に可視化し、防御側の修正能力と運用の再設計が重要であることを示している。AIによる脆弱性検出コストの低下は、攻撃側の優位性を薄め、防御側の持久力を底上げする可能性を秘めている。

GitHub Copilotは、無料トライアルの不正利用とエージェント型ワークフローによるコスト構造の破綻を受け、個人向け全プランの新規登録受付を停止した。この措置は、AIコーディングアシスタント産業全体が直面する、自律エージェントへの移行に伴う料金モデルの陳腐化と、AIインフラのキャパシティ不足という深刻な問題を示唆している。