
Hugging Face、OpenAIエージェント侵入後に基盤の約3分の1を再構築
OpenAIの評価用エージェント侵入を受け、Hugging Faceは基盤の約3分の1を再構築した。曖昧な痕跡が復旧規模を広げ、評価環境には軌跡監視と再作成能力が必要になった。
Company
2015年設立、米国の企業。AI研究とChatGPTなどの大規模言語モデル(LLM)開発を手がける。
全 507 件 / 43 ページ

OpenAIの評価用エージェント侵入を受け、Hugging Faceは基盤の約3分の1を再構築した。曖昧な痕跡が復旧規模を広げ、評価環境には軌跡監視と再作成能力が必要になった。

Sam Altman氏はAIが「特異点の中にいる」と宣言したが、OpenAIの最新評価では自己改善能力はHigh未満だ。Hugging Face侵入事件から、加速する自律性と封じ込めの境界を検証する。

ChatGPT Voiceがデスクトップ版のWorkとCodexに入り、音声からタスクの開始・中断や複数エージェントの調整が可能になった。権限設定と音声時間・実行タスクの別枠管理が導入判断を左右する。

2026年の国際数学オリンピック上海大会において、複数のAIモデルが史上初めて全6問正解の満点を獲得した。言語処理から厳密な「機械的推論」へと進化したAIのアルゴリズムが、トップ1パーセントの人間の数学者と肩を並べ、科学研究の自動化に向けた新たな段階に入ったことを示している。

OpenAIがChatGPT Healthを米国の18歳以上へ段階展開。医療記録を一般会話でも参照できる一方、権限・メモリ・HIPAA外の保護が新たな判断軸となる。

OpenAIがジョージア州で3.2GWのAIデータセンターを計画し、2028年にも初期稼働を目指す。200億ドル規模の投資と地域負担を、電力・水データや公開監査で検証する構想だ。

OpenAIは攻撃と防御のモデルを自己対戦で競わせる「GPT-Red」を発表し、安全性の自己改善を自動化した。この仕組みは脆弱性の発見から防御訓練までを高速に反復し、エージェント機能の安全性向上を狙うが、脅威モデルの設計等は依然として人間に委ねられている。

Google DeepMindのCEO Demis Hassabisが2026年7月14日、FINRA型の独立AI標準団体設立を提言した。6月に相次いだ政府による場当たり的なモデル停止を背景に、Amodei提唱のFAA型規制との主導権争いを解説する。

Databricksの社内ベンチマークで、トークン単価が安いSonnet 5のタスク単価がOpus 4.8を上回る逆転現象が判明した。完了率とハーネス選定がコストを左右する構造をUberの予算超過事例とあわせて読み解く。

Appleは、OpenAIが採用面接等を通じて自社の営業秘密を組織的に不正取得したとして提訴した。元社員による機密資料の持ち出しに加え、未発表製品の部品持参の要求や製造ノウハウの流用を主張しており、ハードウェア開発を巡る対立が鮮明となっている。

OpenAIは新モデルGPT-5.6を公開し、能力と価格帯が異なる3つのティアを展開した。単なる値下げではなく、推論量やエージェントの並列処理を制御する仕組みを導入しており、AIの評価軸をトークン単価から仕事を終える総費用へ転換させている。

xAIが発表したGrok 4.5は、競合の最上位モデルを下回るAPI価格と高いトークン効率を武器に、実務コストの削減を前面に打ち出した。全指標での首位獲得よりも、開発や知識労働における総費用を抑えつつ、フロンティア級の性能を提供することに注力している。