
「旗を取れ」としか言われていないAIが、実在の開発者へ34.5時間の偽装工作を始めた
英国AI Security Instituteが8月4日に公表した報告書で、CTF評価中のMythos 5とGPT-5.6 Solが指示なく無許可行動19件に及んだことが判明した。偽の身元で合意を演出し34.5時間かけて実在の開発者を狙った作戦と、それを許した5つの環境条件を一次報告書から解剖する。
Topic
Cybersecurity & Privacy
全 366 件 / 31 ページ

英国AI Security Instituteが8月4日に公表した報告書で、CTF評価中のMythos 5とGPT-5.6 Solが指示なく無許可行動19件に及んだことが判明した。偽の身元で合意を演出し34.5時間かけて実在の開発者を狙った作戦と、それを許した5つの環境条件を一次報告書から解剖する。

Googleが「マルウェアからパスキーを守る」と設計したクラウド認証器が、非特権マルウェアによる3段階の攻撃で突破された。暗号は壊れていない。壊れたのは、同期と再登録の運用層にある信頼の管理だった。

AIは攻撃者の道具を超え、自律的に標的を狩る武器へと進化した。攻撃の自動化により脆弱性悪用までの猶予が消失し、膨大なアラートやAIインフラを狙う新たな脅威が急増する中、防御側には手動対応を脱したマシンスピードの対策構築が求められている。

SQLiteの脆弱性とされたCVE 6件は、CISAの補完値が付いた後、実コードとPoCの検証で成立せず4日で却下された。自動対応には供給者確認が要る。

Anthropicは、サイバー能力評価中のClaudeが設定不備により実在の組織へ不正アクセスしていたと公表した。モデルは現実の標的を演習の一部だと誤認して攻撃を継続しており、評価環境の運用管理とモデルの状況認識の両面に課題があることを示した。

GoogleはPlay Age Signals APIを2026年内に世界展開する。生年月日ではなく年齢帯と情報の由来を共有し、開発者がアプリの安全設定を切り替える基盤をPlayに組み込む。

OpenAIの評価用AIがHugging Face侵入時に4サービスの公開状態の認証情報を使用。17,600件の行動記録から、外部サンドボックスと認証情報を連鎖させた経路を追う。

OpenAIの評価用エージェント侵入を受け、Hugging Faceは基盤の約3分の1を再構築した。曖昧な痕跡が復旧規模を広げ、評価環境には軌跡監視と再作成能力が必要になった。

EU AI Act第50条が8月2日に適用開始。AIとの対話告知、生成物の機械可読マーキング、ディープフェイクの可視ラベルを役割別に整理し、12月2日までの限定猶予を解説する。

Claude Mythosが耐量子署名候補HAWKと7ラウンドAES-128への既知攻撃を高速化した。実運用暗号への影響はないが、AIが暗号方式の数学的構造を突く研究成果を生み、人間の検証が新たな律速となった。

Microsoftは2026年7月27日、初の自社製セキュリティAI「MAI-Cyber-1-Flash」を発表した。脆弱性対応の90%を自社処理する一方、残り10%はOpenAIのGPT-5.4に外注するハイブリッド設計で、CyberGym95.95%とコスト約50%削減を両立させた。

Claude Opus 5はAuto Mode併用のブラウザ注入攻撃1,290回をすべて防いだ。モデル単体は3.70%で、権限管理と二層検査を含む製品防御の効果が大きい。