
OpenAI、6年ぶりのオープンモデル「gpt-oss」をリリース:有料モデルが好調な今、あえて無料モデルをリリースする意味とは
OpenAIは2025年8月5日、「gpt-oss-120b」と「gpt-oss-20b」という2つのオープンウェイトモデルを同時に公開した。これは、2019年のGPT-2以来となるオープンソースへの回帰である。プロプラ […]
Term
Mixture of Expertsとは、モデル内に複数用意した専門家ネットワークのうち一部だけを入力ごとに動的に選択・実行する手法である。総パラメータ数を増やしつつ推論時の計算量を抑えられるため、大規模言語モデルの学習・運用コスト最適化に広く用いられている。
全 17 件 / 2 ページ

OpenAIは2025年8月5日、「gpt-oss-120b」と「gpt-oss-20b」という2つのオープンウェイトモデルを同時に公開した。これは、2019年のGPT-2以来となるオープンソースへの回帰である。プロプラ […]

中国のAIスタートアップ、Moonshot AIが発表したオープンソースモデル「Kimi K2」がAI業界に波紋を広げそうだ。これは単なる高性能な大規模言語モデル(LLM)の登場ではなく、AI開発の根底に横たわる「経済学 […]

Googleは、同社が「推論の時代」と呼ぶ新たなフェーズに向けた最新AIアクセラレータ「Ironwood」を発表した。第7世代となるこのTensor Processing Unit (TPU)は、Google史上初めて推 […]

中国の新興AIスタートアップDeepSeekが、人工知能の歴史に新たな一章を刻む革新的な言語モデル「DeepSeek-R1」を発表した。このモデルは、業界最高峰とされるOpenAIの「o1」と同等の性能を持ちながら、驚異 […]

中国のAIスタートアップ「SenseTime」社は、マルチモーダル大規模言語モデル(LLM)の「SenseNova 5.0」を発表した。これまであまり名前を聞いたことのないこの企業は、今回ある主張によって一挙に注目を集め […]