
サイエンス
AIは「賢いフリ」をしていた──ハーバード大などが暴いたLLMの決定的弱点「ポチョムキン理解」とは?
大規模言語モデル(LLM)は、流暢な会話をこなし、専門的な質問にも答える。その驚くべき能力に、私たちは「AIは本当に理解しているのではないか」という期待を抱きがちだ。しかし、その知性は本物なのだろうか? こうした我々の抱 […]
Qwen(通義千問)シリーズの視覚言語モデルで、高解像度の画像や長尺の動画を詳細に解析する能力を持ちます。文書理解、物体検出、複雑な視覚的推論を得意としています。本研究の評価対象に含まれましたが、概念の定義と応用のギャップを示すポチョムキン率においては、他のモデルと同様に高い数値を示し、視覚理解モデルにおいても「見せかけの理解」が課題であることが示唆されました。

大規模言語モデル(LLM)は、流暢な会話をこなし、専門的な質問にも答える。その驚くべき能力に、私たちは「AIは本当に理解しているのではないか」という期待を抱きがちだ。しかし、その知性は本物なのだろうか? こうした我々の抱 […]

ShakespeareとByronの時代はついに終わりを告げたのか?科学哲学者のBrian PorterとEdouard Macheryによる新しい研究によれば、最新のAIが生成する詩は「人間が書いた詩と区別がつかず」、 […]