
テクノロジー
OpenAI、人間を超えるAIの暴走を防ぐため、計算能力の20%を優先的に使えるスーパーチームを結成し研究を進める
OpenAIは、トップクラスの機械学習研究者とエンジニアで構成される新チーム「Superalignment」を社内に設立する事を発表した。このチームの目的は、「人間を超える超知能を持つ人工知能が暴走しないよう」に、スケー […]
Term
強化学習とは、エージェントが環境との相互作用を通じて得る報酬を最大化するように行動方針を学習する機械学習手法である。大規模言語モデルの人間フィードバックによる調整(RLHF)やAIエージェントの自律的な意思決定学習に用いられる。
全 26 件 / 3 ページ

OpenAIは、トップクラスの機械学習研究者とエンジニアで構成される新チーム「Superalignment」を社内に設立する事を発表した。このチームの目的は、「人間を超える超知能を持つ人工知能が暴走しないよう」に、スケー […]

Google DeepMindは、同社の有名なAIである「AlphaGo」の能力と、OpenAIのChatGPTを支える技術であるGPT-4のような大規模言語モデルを組み合わせた「Gemini」と呼ばれる画期的なAIシス […]