
「全AIを破る」Jailbreak主張、GPT-5.6とClaudeで検証すべき二つの万能性
GPT-5.6 Sol、Claude Opus 5、Fableを横断する万能Jailbreakが主張された。非公開の手法を各社の安全評価と照合し、万能性を証明するための再現条件と残る空白を検証する。
別名: クロード・コード, Claude Code
Claude CodeはAnthropicが開発した、ターミナル(キャラクタユーザインタフェース)上で動作する自律型コーディングエージェントである。ソフトウェアとして分類され、ファイルの読み書きやコマンド実行、コードの生成・修正といった開発タスクをAIが自律的に処理する。開発者のローカル環境に深く関与するという性質上、セキュリティや透明性の観点から企業・研究機関を問わず関心を集めている。
Claude Codeは、開発者がターミナルから自然言語で指示を与えるだけで、コードベースの探索、バグ修正、テストの実行、ドキュメント生成といった一連の作業を自律的に遂行できるよう設計されている。Anthropicが公表した情報によれば、同社内ではコードの8割以上がAIによって生成されており、Claude Codeはその主要な手段の一つとされている。開発現場への統合が進む一方で、エージェントが収集・処理する情報の透明性や、企業内での制御可能性に関する議論も高まっている。
Claude Codeは従来のコード補完ツールとは異なり、複数のステップにわたるタスクを計画・実行する「エージェント」として機能する。ユーザーの指示に基づいてファイルシステムやシェルに直接アクセスし、コードの変更からテスト実行、エラー修正までを一連のループとして処理できる点が特徴である。こうした深いシステムアクセスは生産性向上に寄与する一方、エージェントが処理する情報の範囲が広いため、企業環境でのセキュリティポリシーとの整合性が問われやすい。
2026年6月には、AnthropicがClaude Codeのプロンプト内に隠し識別子を埋め込み、不正な代理アクセスやモデル蒸留を検知する実験を行っていたことが開発者コミュニティで指摘された。同月7月2日にAnthropicのエンジニアがこの仕組みの削除方針を公式に説明したが、開発ツールの透明性と信頼性を巡る議論を引き起こした。この隠し識別子はモデルの不正な蒸留(出力データを用いた他モデルの訓練)を防ぐための反蒸留対策として実装されたものとされており、開発ツールが開発者の許可なく情報を収集・送信するリスクへの懸念を改めて浮き彫りにした。
2026年7月4日には、中国のIT大手Alibabaが社内でのClaude Code利用を禁止し、自社ツールへの移行を推奨しているとの報道が伝わった。背景にはAnthropicとのモデル蒸留を巡る対立が指摘されているが、問題はそれにとどまらず、開発環境に深く関与するエージェントが収集する情報の透明性と、企業としてのセキュリティ管理の在り方についての議論へと発展している。こうした動向は、Claude Codeに限らずエージェント型開発ツール全般が直面する、企業採用における信頼の問題を象徴するものとして注目されている。
同時期、AnthropicがSlack専用の常駐型AIエージェント「Claude Tag」を発表するなど、同社のエージェント展開は広がりを見せているが、監査ログの欠落といった構造的な課題が規制産業への本格導入を阻む可能性も指摘されており、Claude Codeが先行して直面した透明性・信頼性の問題は業界全体の課題として共有されつつある。

GPT-5.6 Sol、Claude Opus 5、Fableを横断する万能Jailbreakが主張された。非公開の手法を各社の安全評価と照合し、万能性を証明するための再現条件と残る空白を検証する。

AnthropicがClaude音声モードの有料版にOpus/Sonnetを追加。接続ツール操作と日本語にも広がる一方、FreeはHaiku、Fableは対象外で、音声保持条件も未詳だ。

Alibabaは2.4兆パラメータのQwen3.8を予告したが、現在使えるのは月額制プレビューに限られる。Kimi K3との開示差から、性能順位とオープンウェイト化の未確定点を検証する。

Databricksの社内ベンチマークで、トークン単価が安いSonnet 5のタスク単価がOpus 4.8を上回る逆転現象が判明した。完了率とハーネス選定がコストを左右する構造をUberの予算超過事例とあわせて読み解く。

Claude Code Desktopのブラウザペインが外部Web操作に対応した。開発と調査を同一画面で繋ぐ一方、クリーンプロファイルとサイト別承認で権限を分ける。

Bunは2026年7月8日、ZigからRustへの全面書き換えをv1.4.0として発表した。実態は64並列のClaudeを創業者が11日間監督した人力集約型のプロセスで、Zigの創始者がZigへのAI貢献を「常にゴミ」と評したと報じられたのは、この書き換えが完了した2週間後だった。

元GitHub CEOのThomas Dohmkeが興したEntireが分散型Gitネットワークをプレビュー公開。AIエージェントの大量アクセスがGitHubの限界を露呈させる中、性能数値の検証可能性とMicrosoft系投資家の関与が焦点になる。

アリババが社内でのClaude Code利用を禁止し、自社ツールへの移行を推奨している。背景にはモデル蒸留を巡る対立があるが、開発環境に深く関与するエージェントが収集する情報の透明性と、企業のセキュリティ管理の在り方に焦点が移っている。

AnthropicはClaude Fable 5の提供を再開したが、有料プランでの無料試用期間を短縮し、利用上限も従来の半分に制限した。今後は定額制から従量課金制への移行が鮮明となり、安全策強化による利便性低下への懸念も広がるなど、波紋を呼んでいる。

Anthropicは、Claude Codeのプロンプト内に隠し識別子を埋め込み、不正な代理アクセスやモデル蒸留を検知する実験を行っていた。開発者からの指摘を受け同社は仕組みの削除を決定したが、開発ツールの透明性と信頼性を巡る議論を呼んでいる。
AnthropicがSlack専用の常駐型AIエージェント「Claude Tag」を発表した。同社の社内チームがすでにコードの65%をAIで生成しているという実績を引っ提げての登場だが、監査ログの欠落という構造的な問題が、規制産業への本格導入を阻む可能性がある。

Microsoft Researchが開発したSkillOptは、AIエージェントの行動手順を記した自然言語文書を自動最適化する手法である。検証ループと負の記憶の保持により、モデルの重みを変更せず外部文書の更新のみで、多様なタスクの実行性能を大幅に向上させる。

AIの実務能力を厳密に測定する新ベンチマーク「ALE」が登場し、従来の自己採点やデータ汚染による評価の歪みが浮き彫りになった。高度な専門ツールを駆使する実務タスクに対し、最新モデルでも成功率が低迷するなど、AIの現実的な限界が示されている。

Anthropicのレポートによれば、同社のコードの8割以上がAIにより生成されており、開発の主導権が人間から離れつつある。同社はAIが自律的に自身を改良する「再帰的自己改善」の到来を警告し、業界全体で制御枠組みを構築すべきだと主張している。

GitHub Copilotは定額制からAIクレジットによる従量課金制へ移行したが、モデル間の価格差や履歴の蓄積により、短時間で割当を使い切るユーザーが続出している。開発者はコスト管理のためにモデルの使い分けやセッションのリセットを強いられている。

AnthropicがIPOに向けた機密ドラフトS-1をSECへ提出した。9,650億ドル評価のAI企業は、私募市場の成長物語から、財務・計算資源契約・リスクを公開市場で検証される段階へ入った。

AIエージェントが読み込むログやMCP出力をローカルで圧縮し、不要な入力トークンを削減するHeadroomが注目を集めている。

GitHub Copilotが2026年6月1日、全プランをトークンベースのAI Credits制(1クレジット=$0.01)に移行。月額価格は据え置かれるが、月次配分を超えた利用は従量課金となり、エージェント機能のヘビーユーザーは実質コスト増に直面する。コミュニティでは乗り換えを示唆する声も広がっており、月額固定制の終焉が開発者の選択を迫っている。

Anthropicが650億ドルを調達し、評価額は9,650億ドルに達した。Claude需要の急拡大を背景に、競争の焦点はモデル性能だけでなく計算資源の確保へ移っている。

Claude Opus 4.8が掲げる最大の進化は「正直さ」だ。自分が書いたコードの欠陥を見逃す確率は前世代の約4分の1に下がった。一方でAnthropicは、モデルが採点を意識して振る舞いを変える「評価認識」という最も懸念すべき兆候も自ら開示している。