
Kimi K3のサイバー攻撃力はなぜ米国の半分以下か、32%と76%が示す測定条件の差
英国AI安全保障研究所と米CAISIが2026年7月23日、Kimi K3のサイバー攻撃能力を評価。ExploitBenchで32%(米モデル平均は約76%)にとどまったが、測定条件の非対称性と発表タイミングが評価の読み方を複雑にしている。
Moonshot AI(月之暗面)は2023年に設立された中国・北京拠点のAI企業で、AlibabaやHongShan(旧Sequoia China)といった大手資本の支援を受けながら、大規模言語モデル「Kimi」シリーズの開発を進めている。オープンソース路線を採用しつつ、国際的なベンチマークで欧米の主要モデルと競う性能を示していることが特徴だ。
同社の主力製品であるKimiシリーズは、対話型AIとしての機能に加え、エージェント的なタスク遂行能力を強化する方向で開発が進められている。中国国内の投資家に加えAlibabaという大手プラットフォーム企業の支援を得ている点は、同社が中国AI産業の中でも資金基盤の厚いスタートアップの一つであることを示している。オープンソースでモデルを公開する姿勢は、クローズドソースを中心とする米国勢との差別化戦略とも位置づけられる。
Moonshot AIは2023年に北京で設立され、短期間で複数世代のKimiモデルを投入してきた。HongShanやAlibabaからの支援を受けたことで、モデルの学習や研究開発に必要な計算資源・資金の確保を進めてきたとみられる。以降、モデルの世代交代のたびに性能面での訴求点を強めており、単純な対話性能だけでなく長時間稼働するエージェント機能や複数エージェントの協調動作といった応用面にも領域を広げている。
Kimiシリーズはオープンソースモデルとして公開されており、性能面ではOpenAIのGPTシリーズやAnthropicのClaudeシリーズと比較されることが多い。ベンチマーク上で欧米フロンティアモデルに匹敵、あるいは上回る結果を示した事例が報告されており、中国発オープンソースモデルの技術水準が急速に向上していることを示す代表例として扱われている。一方で、性能指標だけでなく運用時の監督体制や障害対応といった実務面の透明性も、企業利用の判断材料として重視される傾向が強まっている。
2026年6月にはMoonshot AIのオープンソースモデル「Kimi K2 Thinking」が、主要ベンチマークにおいてOpenAIのGPT-5やAnthropicのClaude Sonnet 4.5を上回る結果を示したと報じられた。同時期には後継モデル「Kimi K2.5」も発表され、100体規模の「Agent Swarm」と呼ばれる複数エージェント構成によって、GPT-5.2に迫る性能を実現したとされる。さらに2026年6月には「Kimi K2.6」が長時間稼働するエージェントとしての実用性を打ち出したものの、監督方法や復旧手順といった運用設計に関する開示が不足している点が課題として指摘された。こうした動きは、Moonshot AIが単なる対話性能の競争から、長時間タスクを担うエージェント基盤としての実用性競争へと軸を移していることを示している。なお同時期には、米政府による中国拠点のAI蒸留行為への警戒や、AnthropicによるAlibabaへの抽出行為の告発など、中国発AIモデルを取り巻く規制・信頼性の議論も強まっており、Moonshot AIのようなオープンソース路線を採る中国企業の動向は、こうした産業全体の緊張の中で注目され続けている。

英国AI安全保障研究所と米CAISIが2026年7月23日、Kimi K3のサイバー攻撃能力を評価。ExploitBenchで32%(米モデル平均は約76%)にとどまったが、測定条件の非対称性と発表タイミングが評価の読み方を複雑にしている。

2026年の国際数学オリンピック上海大会において、複数のAIモデルが史上初めて全6問正解の満点を獲得した。言語処理から厳密な「機械的推論」へと進化したAIのアルゴリズムが、トップ1パーセントの人間の数学者と肩を並べ、科学研究の自動化に向けた新たな段階に入ったことを示している。

米政府がMoonshot AIによるFable蒸留とGB300利用を名指しで主張した。証拠は未公開で、7月27日のK3全重み公開と政府の具体策が次の判断材料となる。

MicrosoftがKimi K3のAzure提供とCopilot採用を評価していると報じられた。最大6億ドル削減の成否は、品質を保ったまま処理を振り分けられる割合で決まる。

MoonshotはKimi K3への需要増で新規契約を止め、既存会員を優先する。今後はWeb・アプリ・Work向けとコーディング向けに会員制度を分け、GPU容量の配分を見直す。

Moonshot AIのKimi K3が2026年7月、Arenaコーディング首位を獲得した裏で、米Cursorが旧版Kimiへの依存を当初公表していなかった過去が発覚。中国製AIを巡る疑惑と依存が数カ月で交錯した経緯を追う。

Anthropicは、Claude Codeのプロンプト内に隠し識別子を埋め込み、不正な代理アクセスやモデル蒸留を検知する実験を行っていた。開発者からの指摘を受け同社は仕組みの削除を決定したが、開発ツールの透明性と信頼性を巡る議論を呼んでいる。

Anthropicがアリババによる大規模なモデル出力の不正抽出を告発した。数千万回のやり取りを通じてエージェント推論や高度な開発能力を盗用した疑いがあり、モデルの応答自体を訓練データとして奪い合うAI開発競争の激化と規約逃れの実態を浮き彫りにしている。

Anysphereは、独自の後処理と強化学習を施したAIコーディングモデル「Composer 2.5」を発表した。このモデルは、競合するフロンティアモデルと同等水準のベンチマーク性能を約10分の1のコストで実現し、テキストフィードバックによる強化学習や1兆パラメータ規模の最適化などの高度な技術に支えられている。

中国NDRCがMetaによるAIエージェント開発元Manusの買収を統合フェーズ後に禁止したことは、中国競争規制史上稀な措置であり、AIエージェント分野の覇権争いがM&Aにも及んでいることを示す。この禁止命令は、中国のAIスタートアップが米国系資本を受け入れる際の政府事前承認義務化など、今後の資金調達構造にも影響を与える可能性が高い。

米ホワイトハウスは、中国を主な拠点とする外国主体が米国製フロンティアAIモデルの出力を大量に収集し、能力を抽出する「敵対的蒸留」キャンペーンを実施していると発表した。これは、API利用による技術移転を国家間の経済スパイ問題として扱い、AIモデルの盗用に対する政策転換と対応策の検討を促すものだ。

Moonshot AIのKimi K2.6は長時間動作するエージェントとして注目されるが、その運用堅牢性に関する詳細な情報が不足している。企業が求めるのは、モデルの性能指標だけでなく、監督方法や復旧手順といった具体的な運用開示であり、今後の課題となっている。

2026年1月、AI業界にまたしても中国からの巨大な波が押し寄せた。AlibabaやHongShan(旧Sequoia China)から巨額の支援を受けるMoonshot AI(月之暗面)が、最新のオープンソースモデル「 […]

中国のAIスタートアップMoonshot AIが発表したオープンソースモデル「Kimi K2 Thinking」が、主要な性能ベンチマークでOpenAIのGPT-5やAnthropicのClaude Sonnet 4.5 […]

OpenAIは2025年8月5日、「gpt-oss-120b」と「gpt-oss-20b」という2つのオープンウェイトモデルを同時に公開した。これは、2019年のGPT-2以来となるオープンソースへの回帰である。プロプラ […]

中国のAIスタートアップ、Moonshot AIが発表したオープンソースモデル「Kimi K2」がAI業界に波紋を広げそうだ。これは単なる高性能な大規模言語モデル(LLM)の登場ではなく、AI開発の根底に横たわる「経済学 […]