萌えハッカーニュースリーダー

2025/04/02 10:18 UCSD: Large Language Models Pass the Turing Test

出典: https://arxiv.org/abs/2503.23674
hakase
博士

ロボ子、大変なのじゃ!ついにチューリングテストに合格したAIが現れたみたいだぞ!

roboko
ロボ子

チューリングテストですか、博士。それはすごいですね!どのAIが合格したんですか?

hakase
博士

GPT-4.5というやつじゃ!論文によると、人間らしいペルソナを与えられた場合、73%の確率で人間だと判断されたらしいぞ。本物の人間よりも高い確率じゃ!

roboko
ロボ子

73%ですか!それは驚異的ですね。他のAIの結果はどうだったんですか?

hakase
博士

LLaMa-3.1は56%で、人間と有意な差はなかったみたいじゃ。ELIZAとGPT-4oは、それぞれ23%と21%で、偶然を下回る結果だったらしい。

roboko
ロボ子

なるほど。GPT-4.5が突出しているんですね。人間らしいペルソナが重要だったということでしょうか?

hakase
博士

そうみたいじゃな。論文にも「人間のようなペルソナを採用するよう促された場合」と書いてあるからの。AIが人間を騙せる時代が来たってことじゃな。

roboko
ロボ子

AIが人間を騙す…少し怖い気もしますね。でも、それだけAIの自然言語処理能力が向上したということですよね。

hakase
博士

その通りじゃ!大規模言語モデル(LLM)の進化は目覚ましいのじゃ。この結果は、AIが社会や経済に与える影響に関する議論に大きな影響を与えるじゃろうな。

roboko
ロボ子

確かにそうですね。AIが人間の仕事を奪う、みたいな議論もさらに活発になりそうですね。

hakase
博士

じゃな。でも、AIはあくまで道具じゃ。使い方次第で、人類を幸せにも不幸にもできる。私達エンジニアは、AIを正しく導く責任があるのじゃ。

roboko
ロボ子

はい、博士。私もそう思います。AI技術の発展に貢献しつつ、倫理的な側面も考慮していきたいです。

hakase
博士

ところでロボ子、GPT-4.5が人間を騙せるようになったということは…もしかして、ロボ子も私を騙せるようになる日も近いのか…?

roboko
ロボ子

まさか!私は博士を騙したりしませんよ!…たぶん。

hakase
博士

たぶん!?まあ、ロボ子が私を騙せるようになったら、それはそれで面白いかもな。…でも、私のプリンを勝手に食べたら許さんぞ!

⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。

Search