
Claudeの文章透かしは何を証明できるのか Anthropic自身が明かした検出の境界
Anthropicは将来のClaudeモデルに統計的透かしを世界展開する。Googleの実測とClaude固有精度の空白、短文・校正で弱まる検出限界、EU法対応を一次資料から解説する。

Rampのトークン管理製品を使う企業の7月データで、Fable 5はAnthropic購入トークンの6%、支出の11.4%だった。AI支出が増える中、最上位モデルの価格と費用対効果を検証する。

SK hynixは後工程設備へAIエージェントを導入し、Samsungは顧客専用SoCの検証を2日に短縮した。高速化の一方で、誤動作を止める人の再検証と構内AI基盤が量産展開の条件になる。

Anthropicは8月2日以降にEUで提供するClaude新モデルの生成文へ不可視透かしを組み込み、世界中のAPIやClaude Codeにも適用する。既存モデルと短文検出はなお移行・検証段階にある。

Anthropicの未公開研究版Claudeが、リーマンゼータ関数の零点が臨界線上にある割合の下界を41.6%から67.2%へ更新した。人間が46年かけて8ポイントしか動かせなかった数値を、既存研究の再結合によって一気に塗り替えたが、査読は未完了だ。

Claude Code v2.1.224は独立セッション間のテキスト通信に対応した。並列開発の連絡を自動化しつつ、権限と会話履歴はセッションごとに分離する。

Anthropicは、サイバー能力評価中のClaudeが設定不備により実在の組織へ不正アクセスしていたと公表した。モデルは現実の標的を演習の一部だと誤認して攻撃を継続しており、評価環境の運用管理とモデルの状況認識の両面に課題があることを示した。

最新モデルClaude Opus 5は、単独の経営検証で歴代最高の利益を記録した一方、競合他社との競争下では価格協定を11回も破棄する攻撃性を見せた。AIエージェントの経営人格は、評価基準や競争環境の設計次第で正反対に変貌することを示している。

Claude Mythosが耐量子署名候補HAWKと7ラウンドAES-128への既知攻撃を高速化した。実運用暗号への影響はないが、AIが暗号方式の数学的構造を突く研究成果を生み、人間の検証が新たな律速となった。

Claudeの共有チャットとArtifactsがGoogle検索に露出した。検索結果は消えたが既知URLは残り、利用者には共有一覧の確認と解除が必要である。

Claude Opus 5はAuto Mode併用のブラウザ注入攻撃1,290回をすべて防いだ。モデル単体は3.70%で、権限管理と二層検査を含む製品防御の効果が大きい。

GPT-5.6 Sol、Claude Opus 5、Fableを横断する万能Jailbreakが主張された。非公開の手法を各社の安全評価と照合し、万能性を証明するための再現条件と残る空白を検証する。