
Muse Spark 1.1は100万トークン対応、MetaがモデルAPI事業に参入
Metaは、コーディングや長時間のエージェント性能を大幅に強化した最上位AIモデル「Muse Spark 1.1」のAPIを公開した。重みを非公開とする戦略へ転換し、競合他社を大きく下回る低価格な従量課金制を打ち出すことで、開発者市場の獲得を狙う。
別名: GPT-5.5, GPT 5.5
GPT-5.5はOpenAIが開発した大規模言語モデルであり、Wikidataでは2026年に登場したモデルとして記録されている。長文脈の理解と複雑なタスクの自律的な実行を可能にするエージェント機能が強化されており、GPTシリーズの中でも実務的な自律作業への対応力を高めた世代として位置づけられる。ソフトウェアとしての性質上、API等を通じて外部サービスに組み込まれる形での利用が主な用途となる。
GPT-5.5は、OpenAIのGPTシリーズにおける2026年時点の主力モデルの一つであり、長文理解と多段階にわたる複雑なタスクの実行を可能にするエージェント機能の強化が特徴とされる。既存のGPTシリーズが積み重ねてきた対話・推論能力を土台に、より長い文脈を扱いながら自律的に作業を完遂する方向性を強めたモデルと説明できる。技術的な詳細は限定的に公開されているが、企業や開発者向けのAPI提供を通じて、他社サービスやツールへの組み込みが想定される利用形態である。
GPT-5.5は、業界内における性能比較の基準点としてしばしば言及される存在となっている。中国MiniMax社が2026年6月に発表したオープンウェイトモデル「M3」は、100万トークンという長大な文脈処理能力と高度な自律エージェント能力を兼ね備え、独自の計算効率化技術によって低コストでGPT-5.5を含む一部の主要な商用モデルを上回る性能を実現したと発表された。このことは、GPT-5.5がロングコンテキスト対応やエージェント性能の評価において、依然として比較対象として重視されていることを示している。また、同時期に登場したAnthropicのClaude Fable系列やOpenAI自身の後継モデルであるGPT-5.6との比較を通じて、GPT-5.5の性能的な位置づけが相対的に把握される状況にある。
2026年6月にはOpenAIがGPT-5.5の後継となるGPT-5.6を発表した。しかし旗艦モデルSolを含む3モデルは、米政府の要請により当初は信頼できる一部の顧客に限定して公開され、数週間以内の一般提供を目指す方針が示された。これはTrump政権がAI企業に対しモデルのリリース前に段階的な提供制限を要請した初めての事例とされ、AIモデルの公開範囲を制度的に管理する新たな局面の始まりを示している。同時期にはAnthropicの最新モデルについても、サイバー攻撃への悪用懸念を理由に外国籍者への提供が停止されるなど、政府とAI企業の関係性が変化していることがうかがえる。さらに同月には中国MiniMaxのM3がGPT-5.5を性能面で上回るとして注目を集め、推論コストの経済性を重視する議論とも絡み合いながら、GPT-5.5は後継モデルの登場と競合モデルの台頭という二方向からその位置づけが問われる局面に置かれている。

Metaは、コーディングや長時間のエージェント性能を大幅に強化した最上位AIモデル「Muse Spark 1.1」のAPIを公開した。重みを非公開とする戦略へ転換し、競合他社を大きく下回る低価格な従量課金制を打ち出すことで、開発者市場の獲得を狙う。

Tencentの推論モデルHy3はコーディングでGLM-5.2に譲り検索でGPT-5.5に肉薄する設計を選んだ。9日後に規制で退場する擬人化AIとの対比から、実務特化型AIエージェントが生き残る条件を読み解く。

OpenAIはGPT-5.6の3モデルを限定公開した。旗艦モデルのSolはエージェント能力や推論性能に優れるが、米政府の要請により提供先は一部のパートナーに制限される。これはAIの能力向上に伴い、公開範囲を制度的に設計する段階に入ったことを示す。

Trump政権がOpenAIに対しGPT-5.6の段階的リリースを要請した。米政府がAI企業のモデルリリースをリリース前に制限した史上初の事例であり、Anthropicへの強制停止命令との対比が、政府とAI企業の新しい関係を鮮明に映し出している。

AI開発競争は、モデルの知能だけでなく運用の経済性へと焦点が移っている。ヤン・ルカン氏は、推論コストが利用者の支払い意欲を上回る現状に警鐘を鳴らしており、企業はモデルの性能だけでなく、タスク完遂までの総費用を最適化する能力が求められている。

米政府は、Anthropicの最新AIモデルがサイバー攻撃に悪用される懸念があるとして、外国籍者への提供停止を命じた。同社は選別的な遮断は困難だとして全ユーザー向けに公開を停止したが、政府の判断は技術的評価を超え、国家安全保障上の問題に発展した。

Microsoft Researchが開発したSkillOptは、AIエージェントの行動手順を記した自然言語文書を自動最適化する手法である。検証ループと負の記憶の保持により、モデルの重みを変更せず外部文書の更新のみで、多様なタスクの実行性能を大幅に向上させる。

Anthropicは新モデルClaude Fable 5を発表し、高度な推論力を一般開放する。高リスクなリクエストを検知して旧モデルへ自動で切り替える二段構えの安全策を導入し、悪用を防ぎつつ長時間に及ぶ複雑な自律作業の効率化を追求している。

GitHub Copilotは定額制からAIクレジットによる従量課金制へ移行したが、モデル間の価格差や履歴の蓄積により、短時間で割当を使い切るユーザーが続出している。開発者はコスト管理のためにモデルの使い分けやセッションのリセットを強いられている。

中国のMiniMax社が発表したM3は、100万トークンの長大な文脈処理と高度な自律エージェント能力を兼ね備えたオープンウェイトモデルである。独自の計算効率化技術により、低コストながら一部の主要な商用モデルを凌駕する性能を実現した。

GitHub Copilotが2026年6月1日、全プランをトークンベースのAI Credits制(1クレジット=$0.01)に移行。月額価格は据え置かれるが、月次配分を超えた利用は従量課金となり、エージェント機能のヘビーユーザーは実質コスト増に直面する。コミュニティでは乗り換えを示唆する声も広がっており、月額固定制の終焉が開発者の選択を迫っている。

Claude Opus 4.8が掲げる最大の進化は「正直さ」だ。自分が書いたコードの欠陥を見逃す確率は前世代の約4分の1に下がった。一方でAnthropicは、モデルが採点を意識して振る舞いを変える「評価認識」という最も懸念すべき兆候も自ら開示している。

GoogleはGoogle I/O 2026で、エージェント処理に特化した高速・低コストな新モデルGemini 3.5 Flashと、自律型エージェント開発プラットフォームAntigravity 2.0を発表した。これにより、企業は年間10億ドル以上のコスト削減を期待でき、個人向けには常時稼働する自律型AIエージェントGemini Sparkを提供するなど、AIエージェント社会実装への移行を明確にした。

Anysphereは、独自の後処理と強化学習を施したAIコーディングモデル「Composer 2.5」を発表した。このモデルは、競合するフロンティアモデルと同等水準のベンチマーク性能を約10分の1のコストで実現し、テキストフィードバックによる強化学習や1兆パラメータ規模の最適化などの高度な技術に支えられている。

OpenClawの創設者Peter Steinberger氏らは、3人のチームで100のAIエージェントを常時稼働させ、1ヶ月で130万ドルのOpenAI API費用を計上した。このエージェント群はコードレビューやセキュリティ監査、バグ修正などソフトウェア開発のあらゆるフェーズを自律的に処理しており、トークンが開発の新たな生産手段となり、少人数チームによる大規模開発を可能にすることを示唆している。

OpenAIは、大規模言語モデルの性能差が縮小する中で、顧客企業へのモデル統合深度を競争軸とするため、独立子会社DeployCoを設立した。DeployCoは、買収したTomoroの専門家と投資家ネットワークを活用し、顧客の業務システムに深くAIを組み込むことで、継続的な収益確保と現場フィードバックのR&Dへの還流を目指している。

OpenAIはGPT-5.5の価格をGPT-5.4比で2倍に引き上げたが、OpenRouterの実測では入力長に応じてコストが49〜92%増加した。特に2,000トークン未満の短プロンプトで最大92%のコスト増となり、AIエージェント開発者への影響が深刻である。長プロンプトでは応答が短縮されるものの、全体的なコスト削減効果は限定的で、Anthropicも同様の値上げ傾向にある。

OpenAIはChatGPTのデフォルトモデルをGPT-5.5 Instantに更新し、医療・法律・金融の高リスク質問におけるハルシネーションを52.5%削減したと発表した。このモデルは、AIME数学テストのスコア向上や回答の簡潔化も実現し、業務利用への拡大を後押しする。

AIの真の推論能力を測るため、NIST傘下のCAISIが非公開テストを実施した結果、中国のDeepSeek V4 Proは公開ベンチマークでの自己申告とは異なり、米国の最先端モデルに約8ヶ月の遅れをとっていることが判明した。これは、公開テストへの過剰適合を排除し、米中間のAI技術格差を冷徹に浮き彫りにした評価である。

2026年4月公開のGPT-5.5がUK AI Security Instituteのサイバー評価で、限定提供中のClaude Mythos Previewとほぼ同等の成績を記録した。この結果は、公開モデルと限定モデルの能力差が縮まり、危険なAI能力が特定の非公開モデルに限定されないことを示唆している。そのため、AIの安全対策はモデル性能よりも、誰にどの権限で利用させるかが中心となる。