チューリングテストは、機械に知能があるかどうかを判定するための方法です。1950年に、イギリスの数学者アラン・チューリングが論文の中で提案しました。
この記事では、チューリングテストの基本的なやり方と考え方に加えて、イライザやローブナーコンテストといった関連する例もあわせて見ていきます。
判定に使うのは、機械の内部の仕組みではありません。判定者が相手と文字のやり取りだけで会話し、その相手が機械なのか人間なのかを見分けられるかどうか。外に出てくる振る舞いだけで判定します。
| 言葉 | 年 | 概要 |
|---|---|---|
| チューリングテスト | 1950年 | アラン・チューリングが提案した、機械に知能があるかを判定する方法 |
| イライザ(ELIZA) | 1966年 | ジョセフ・ワイゼンバウムが発表した、人間と文字で会話するプログラム |
| ローブナーコンテスト | 1991年 | チューリングテストを実際の競技として実施する催し |
チューリングテストとは

やり方はこうです。
- 判定者が一人いて、二人の相手と文字のやり取りだけで会話する
- 相手の姿は見えず、声も聞こえない
- 片方は人間で、もう片方は機械である
- 判定者は、会話だけを手がかりに、どちらが機械でどちらが人間かを言い当てようとする
もし判定者が言い当てられないのなら、その機械には知能があると考えてよいのではないか。それがチューリングの提案でした。
判定者が見るのは、相手の返してくる文章だけです。機械がどういう仕組みで動いているのか、どれくらいの処理性能を持っているのかは問われません。
なぜ「機械は考えることができるか」を直接調べないのか

もともとの問いは「機械は考えることができるか」でした。
ところが、この問いに正面から答えようとすると、まず「考える」とは何かを決めなければなりません。そこで話が止まってしまいます。
チューリングは、この問いを、外から観察できる問いに置き換えました。中身がどうなっているかは問わない。外に出てくるやり取りが、人間と区別できるかどうかだけを見る。
ポイント
チューリングテストが与えるのは、知能とは何かという答えではなく、知能があるかどうかを判定するための手続きです。
イライザ:言葉の形だけを扱うプログラムが、人間だと思われた

機械が人間と見分けられない場面は、実際に起きたことがあるのか。よく挙げられるのがイライザです。
1966年、ジョセフ・ワイゼンバウムが、人間と文字で会話するプログラムを発表しました。それがイライザ(ELIZA)です。
仕組みは、拍子抜けするほど単純です。入力された文からキーワードを見つけ、それに結び付いた規則にしたがって、文を組み替えて返す。やっているのは、それだけです。
| 利用者の入力 | イライザの返答 |
|---|---|
| 父のことです | あなたのお父さん |
| ある意味であなたは父に似ています | どんなところが似ていると思いますか |
相手の言葉を拾い、組み替えてそのまま返したり、質問の形にしたりする。言葉の意味が分かっているのではなく、言葉の形だけを扱っています。
ところが、イライザを使った利用者の中には、相手が人間ではないとなかなか納得しない人が出てきました。ワイゼンバウム自身がそのことを報告していて、チューリングテストの顕著な例だと書いています。
定義
意味が分かっていないプログラムに対して、人間が理解や感情を読み取ってしまう。この傾向をイライザ効果と呼びます。
つまり、イライザが賢かったんじゃなくて、人間のほうが読み取っちゃったってこと?
そうです。イライザがやっているのは言葉の組み替えだけで、意味は扱っていません。それでも相手を人間だと感じる人がいた、というのがここでの話です。

ローブナーコンテスト:競技として実施したらどうなったか

イライザの話は、使った人の反応であって、テストとして行った結果ではありません。では、チューリングテストを競技の形で行うとどうなるのか。
1991年に始まったのが、ローブナーコンテストです。チューリングテストを実際の競技として行う催しで、判定者はプログラムとも人間とも文字で会話し、どちらがより人間らしいかを評価します。
第1回で最も高い評価を得たプログラムが使っていたのは、相手の発言をそのまま言い換えて返す、決まった語に反応して答える、といった手法でした。イライザと同じ種類のやり方です。そして、このプログラムを人間だと判定した判定者が、複数いました。
会話の中身を理解する仕組みを持っていなくても、人間だと判定されることがある。イライザで起きたことが、競技の場でも繰り返されました。
まとめ

チューリングテストは、機械に知能があるかを、内部の仕組みではなく、文字のやり取りで人間と見分けがつくかという振る舞いだけで判定しようとした提案です。1950年にアラン・チューリングが示しました。知能の定義ではなく、判定の手続きです。
イライザとローブナーコンテストが示したのは、言葉の形を組み替えているだけのプログラムでも、人は人間だと錯覚してしまうことでした。見分けがつかないことと、本当に考えていることは、同じとは限りません。
次は、この引っかかりを正面から突いた思考実験、中国語の部屋と、強いAI・弱いAIを取り上げます。