
OpenAIのJalapeño、固定長推論でGB300を上回るもRubin比較は未実施
OpenAI初の推論ASIC「Jalapeño」は固定長テストでGB300を上回った。電力効率の強みと、Rubin比較・長文脈検証・量産に残る条件を解説する。
Topic
Generative AI
全 2,431 件 / 203 ページ

OpenAI初の推論ASIC「Jalapeño」は固定長テストでGB300を上回った。電力効率の強みと、Rubin比較・長文脈検証・量産に残る条件を解説する。

Windows 11のプレビュー版内部から、GPUやAI向けに統合メモリを手動配分する隠し機能が見つかった。RTX Sparkなど大容量統合メモリPCの登場を前に、OS側のメモリ管理はどう変わるのかを読み解く。

Canonicalは、数十万行規模のCを安全なRustへ移す3年間の博士研究に投資する。AppArmorなどを実用例に、生成コードの挙動一致と保守性を検証する。

Microsoft ペイントはローカルAI生成でもサーバー発行GUIDを画像とC2PAに記録する。フォトでは同系統のコード経路が見つかったが、個人特定や照合運用は確認されていない。

米ADPの月350万〜500万人の給与記録では、AI高露出職で22〜25歳の雇用が低露出職の伸びに追随せず、差は主に採用率に現れた。観察研究のため因果関係は未確定である。

NVIDIAが量産を始めたGroq 3 LPXは、GPUとLPUの分業で毎秒3,431出力トークンを記録した。性能の意味、ベンチマークの限界、170億ドル契約の狙いを読み解く。

NVIDIAがPerplexityを300億ドル超と評価する追加出資を協議。急成長するエージェント事業と、GPU・CPU・モデル開発にまたがる両社の関係を検証する。

Xiaomiの第2世代SoC「XRING O3」は、3nmのまま高性能CPUコア10基、16コアGPU、LPDDR6、200TOPS NPUへ拡張した。公式値と開発ボード実測を分け、113.8GB/sのメモリ帯域と20W級ピークの意味を検証する。

d-MatrixのRaptorは、3D-DRAMでカード換算約105 TB/sを実測した。一方、推論性能の倍率はモデル評価であり、量産歩留まりや第三者検証は未公表だ。

査読済みの10モデル実験は、AIエージェントの多数派追従が群サイズとモデルで変わると報告した。1,000体は複雑な協働能力ではなく、二択実験の上限値である。

生成AIと能動学習を組み合わせた広告制作システムが、Instagramの平均リンクCTRで人間制作を上回った。ただし、予約や売上への効果は未検証である。

通信会社ではないGoogle、Meta、Amazonなどコンテンツ・クラウド事業者が国際海底ケーブルの帯域75%を使うに至った経緯と、製造は仏Alcatel Submarine Networks、米SubCom、日NECの3社が92%を占めるという所有と製造の二層構造を解き明かす深掘り特集。