人工知能評価手法

チューリングテスト

ちゅーりんぐてすと · Turing Test
18 views

チューリングテストとは、機械が人間と同等の知性を持つかを判定するため、テキスト対話を通じて人間と区別がつかないかを検証する評価手法です。アラン・チューリングによって提唱され、人工知能が思考しているかを議論する上で重要な指標として長く参照されています。

チューリングテストとは

チューリングテストとは、イギリスの数学者・計算機科学者であるアラン・チューリングが1950年に提唱した、機械が人間と同等の知性を持っているかを判定するための評価手法です。

詳しく解説

アラン・チューリングは「機械は思考できるか」という問いに対し、人間と機械がテキスト形式で会話を行い、人間の判定者が相手を機械だと見抜けなければ、その機械は知能を持つとみなす「模倣ゲーム」を考案しました。この概念は自然言語処理の発展や人工知能研究の目標設定に大きな影響を与え、知能の本質を論じる基礎となっています。

具体例・使われ方

具体的な例として、判定役の人間がキーボードを介して会話を行い、応答している相手が人間かプログラムかを判別するコンテストが挙げられます。現代の対話型AIが人間と見分けがつかないほど自然な対話を行えるかを検証する実験などでも参照されます。

似た用語との違い

チューリングテストが外面的な対話の模倣をもって知能を判定するのに対し、思考実験である「中国語の部屋」は、意味を理解せずに記号を操作しているだけでもテストに合格できてしまうため、真の理解や知性とは呼べないと批判する点で対比されます。

注意点

テストを通過したとしても、システムが意識や真の理解を獲得したことや、人間のような汎用人工知能になったことを意味するわけではありません。欺くための受け答えを模倣しているだけのケースもあり、知能を網羅的・客観的に測定する指標としては限界がある点に注意が必要です。

更新日時: 2026年9月20日 04:45