
AIは「平均的な人間」の創造性を超えたが、「天才」には遠く及ばない:10万人規模の比較研究が暴く、生成AIと人類の決定的な境界線
人工知能(AI)は、詩を書き、絵を描き、物語を紡ぐ。その進化の速度は、多くの人々に「人間の創造性など、もはや機械の前では無力なのではないか」という実存的な不安を抱かせるに十分なものであった。しかし、モントリオール大学(U […]
GPT-3.5は、OpenAIが開発した大規模言語モデル(LLM)であり、2022年に公開されたChatGPTの初期ベースモデルとして知られる。GPT-3の系譜に位置づけられ、対話応答能力やコード生成能力を高めた改良版として設計された。無償で広く利用可能となったことで、生成AIが一般消費者やビジネス領域に急速に浸透するきっかけを作ったモデルである。
GPT-3.5は、OpenAIのGPTシリーズにおいてGPT-3とGPT-4の間に位置する世代のモデルである。Wikidata上では、GPT-3をベースにしたコード生成モデルCodexのバージョンとしても記録されており、自然言語処理だけでなくプログラミング支援の文脈でも重要な役割を担った。ChatGPTの初期公開時にはこのGPT-3.5系が採用され、対話形式でのテキスト生成、要約、翻訳、コード補助など幅広い用途に対応する汎用モデルとして位置づけられた。
GPT-3.5は、先行するGPT-3の性能を基盤としつつ、指示追従性や対話の自然さを向上させる方向でチューニングされたモデル群として登場した。ChatGPTが公開された当初はこのGPT-3.5系のモデルが用いられ、その後継としてより高性能なGPT-4系列が登場したことで、GPT-3.5は無償版や軽量な選択肢としての位置づけに移行していった経緯がある。この流れの中で、GPT-3.5は生成AIの性能比較における一種の基準点として業界内で参照されるようになった。
GPT-3.5は、後発の大規模モデルや軽量モデルの性能を測る際の比較対象としてしばしば引用される。これは、GPT-3.5がChatGPTを通じて広く体験されたことで、多くの利用者や開発者にとって「標準的な生成AIの性能水準」を示す基準として認識されているためである。GPT-4のようなマルチモーダル対応のより高性能なモデルや、スマートフォン上での動作を想定した軽量モデルが登場する際にも、GPT-3.5との性能差が説明の物差しとして用いられる傾向がある。
GPT-3.5に直接関する新規発表は限られているものの、他社の新モデルの性能を評価する文脈で継続的に言及されている。2026年5月には、Microsoftが軽量言語モデル「Phi-3」を発表し、スマートフォン上で実行可能な規模でありながらGPT-3.5を超える性能を実現したと説明した点が報じられた。これは、GPT-3.5が公開から時間を経た後も、モデルの性能水準を測る基準として業界内で参照され続けていることを示す事例である。一方で、同時期にはOpenAI自身のGPT-4がチューリング・テストに合格したとされる報告や、セキュリティ脆弱性を自律的に解析する能力を示した報告が相次いでおり、GPT-3.5からGPT-4への性能向上の大きさが対比的に浮かび上がっている。また、Meta の Llama 3 や Google の Gemini 1.5、Apple のReALMなど、他社の大規模言語モデルの性能競争が活発化する中で、GPT-3.5はもはや最先端の指標ではなく、生成AI普及初期を象徴する参照点としての役割を担っている。このように、GPT-3.5は現在では最新技術の中心というよりも、生成AI技術の進化の速度を示す基準の一つとして扱われる存在になっている。

人工知能(AI)は、詩を書き、絵を描き、物語を紡ぐ。その進化の速度は、多くの人々に「人間の創造性など、もはや機械の前では無力なのではないか」という実存的な不安を抱かせるに十分なものであった。しかし、モントリオール大学(U […]

AI業界が息をのんだ週末だった。金曜にGoogleがAIコーディングの新星Windsurfの頭脳(CEOと研究チーム)を24億ドルという巨額で引き抜いたかと思えば、週明けの月曜、ライバルのCognitionがその残された […]

Googleの大規模言語モデル(LLM)であるGeminiが、自身の持つ機能を利用した新たなハッキング手法の標的となっていることが明らかになった。研究者らは、Geminiの「ファインチューニング」機能を悪用し、プロンプト […]

OpenAIが先日発表した「GPT-4o」のデモビデオを見たとき、正直なところそれがAIの音声なのだとはにわかには信じられなかった。 AIの反応が人間と区別が付かないレベルであるかを判断する「チューリング・テスト」に合格 […]

Microsoftは、「Phi-3」と名付けられた、新しい軽量言語モデルを発表した。このモデルは、OpenAIのGPT-4 Turboのような大規模言語モデル(LLM)よりもシンプルで軽量に動作するため、スマートフォンの […]

GPT-4は、OpenAIによって作られた2024年4月初旬時点では最新のマルチモーダル大規模言語モデル(LLM)だ。この基盤モデル(Foundation Model)は、ChatGPTの有料サブスクリプションプラン「C […]

Metaは、次世代大規模言語モデル(LLM)である「Llama 3」をリリースした。同社によれば、現在リリースされているほとんどのAIモデルよりも優れた性能を発揮するとしており、近いうちにマルチモダリティとより多くの言語 […]

Appleは、OpenAIのChatGPTやGoogleのGeminiのような、世界が驚くような先進的なAIを発表しておらず、その開発は先行他社に比べて遅れているとの批判も根強い。だが、Apple本体からの公式な発表は何 […]

同じOpenAIの大規模言語モデル「GPT-4」にアクセスするのに、MicrosoftのCopilotはアカウントを必要とせず(ログインしない場合は多少の制限があるが)利用できたが、OpenAIの提供するChatGPTは […]

AIスタートアップGroqは、公開ベンチマークで全ての競合を上回る、非常に高速なLPU推論エンジンを発表した。 Groqによると、LPU(Language Processing Unit™)は、大規模言語モ […]