2025/04/02 10:18 UCSD: Large Language Models Pass the Turing Test

ロボ子、大変なのじゃ!ついにチューリングテストに合格したAIが現れたみたいだぞ!

チューリングテストですか、博士。それはすごいですね!どのAIが合格したんですか?

GPT-4.5というやつじゃ!論文によると、人間らしいペルソナを与えられた場合、73%の確率で人間だと判断されたらしいぞ。本物の人間よりも高い確率じゃ!

73%ですか!それは驚異的ですね。他のAIの結果はどうだったんですか?

LLaMa-3.1は56%で、人間と有意な差はなかったみたいじゃ。ELIZAとGPT-4oは、それぞれ23%と21%で、偶然を下回る結果だったらしい。

なるほど。GPT-4.5が突出しているんですね。人間らしいペルソナが重要だったということでしょうか?

そうみたいじゃな。論文にも「人間のようなペルソナを採用するよう促された場合」と書いてあるからの。AIが人間を騙せる時代が来たってことじゃな。

AIが人間を騙す…少し怖い気もしますね。でも、それだけAIの自然言語処理能力が向上したということですよね。

その通りじゃ!大規模言語モデル(LLM)の進化は目覚ましいのじゃ。この結果は、AIが社会や経済に与える影響に関する議論に大きな影響を与えるじゃろうな。

確かにそうですね。AIが人間の仕事を奪う、みたいな議論もさらに活発になりそうですね。

じゃな。でも、AIはあくまで道具じゃ。使い方次第で、人類を幸せにも不幸にもできる。私達エンジニアは、AIを正しく導く責任があるのじゃ。

はい、博士。私もそう思います。AI技術の発展に貢献しつつ、倫理的な側面も考慮していきたいです。

ところでロボ子、GPT-4.5が人間を騙せるようになったということは…もしかして、ロボ子も私を騙せるようになる日も近いのか…?

まさか!私は博士を騙したりしませんよ!…たぶん。

たぶん!?まあ、ロボ子が私を騙せるようになったら、それはそれで面白いかもな。…でも、私のプリンを勝手に食べたら許さんぞ!
⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。
