
安いAIを最後まで提供できるのは誰か? OpenAI、Google、DeepSeekが突入した消耗戦
4大ハイパースケーラーの設備投資が7250億ドルへ77%増える一方、OpenAIの入力単価はGPT-4以来83%下落した。DeepSeekが8月に一転値上げした背景から、電力とチップの調達力が価格競争の勝敗を分ける構造を読み解く。
別名: Quantization
通常32ビットや16ビットの浮動小数点で表現されるモデルのパラメータを、8ビットや4ビットなどのより低いビット数に変換する技術。メモリ消費を大幅に抑えられるが、精度がわずかに低下するトレードオフがある。本記事では、投機的デコードがこの精度低下を伴わずに高速化できる点と比較されている。

4大ハイパースケーラーの設備投資が7250億ドルへ77%増える一方、OpenAIの入力単価はGPT-4以来83%下落した。DeepSeekが8月に一転値上げした背景から、電力とチップの調達力が価格競争の勝敗を分ける構造を読み解く。

AMDは、AI超解像技術FSR 4.1をRDNA 3およびRDNA 2世代のRadeon GPUに提供すると発表した。RDNA 3搭載のRX 7000シリーズには2026年7月、RDNA 2搭載のRX 6000シリーズやSteam Deckには2027年初頭に対応予定で、専用AIハードウェア非搭載の旧世代機向けにINT8処理で最適化されている。

Googleは、Gemma 4の推論を最大3倍高速化するMulti-Token Prediction対応ドラフトモデルを公開した。このモデルは、投機的デコード技術によりトークン生成と検証を分離し、VRAM帯域幅のボトルネックを解消することで、エッジデバイスやローカルPCでの推論品質を低下させることなく大幅に改善する。

次期Pixel 11は、AIデータセンター向けHBM需要増によるLPDDR5X価格高騰の影響で、前世代より少ないRAM構成で出荷される見込みだ。しかし、Tensor G6へのTSMC N2プロセス移行やMediaTek製モデム採用、カメラセンサー刷新により、電力効率と通信性能、画質の向上が期待される。

2025年12月現在、テクノロジー業界を駆け巡っている一つの数字がある。「70%」──これは、OpenAIが有料ユーザー向けのサービスにおいて達成したとされる「コンピューティング・マージン(Compute Margin) […]

ドイツ・ケルンで開催されたGamescom 2025の舞台で、NVIDIAは同社のAIアシスタント「Project G-Assist」の未来を占う重要なアップデートを発表した。新しい軽量AIモデルの採用により、これまでハ […]