词条 · AI · 入门
模仿游戏
图灵用来替换"机器能思考吗"的可操作问题:审问者靠打字提问,判断对面是谁;原始设定判断的是男女,不是人机。
也称:模仿游戏、imitation game、图灵测验、图灵测试、Turing test
先看一个吵不出结果的问题
“机器能思考吗?”
试着回答一下,你会立刻卡在同一个地方:得先说清”思考”是什么。而任何定义都会被反驳——定得宽了,恒温器也在思考;定得窄了,只有人类算思考,问题变成同义反复。
这不是耐心不够的问题。这类争论的结构就是无解的:双方对事实没有分歧,只对词该怎么用有分歧。
朴素办法,以及它为什么不够
朴素办法是查字典、定义”思考”,然后看机器符不符合。图灵在 1950 年那篇论文里直接拒绝了这条路,理由是定义会陷入词义之争(他后来说这个问题 too meaningless to deserve discussion)。
第二个朴素办法是”看它内部怎么运作”。但这会预设结论:如果你已经认定”用规则查表就不算思考”,那任何机器实现都不算,因为机器都是规则。
机制:把问题换成一个能操作的问题
图灵的办法是替换问题。不问”能否思考”,问”能否在一个特定游戏里表现得让人分辨不出”。
原始游戏有三个人:男人 A、女人 B、审问者 C。C 只能通过打字与两人交流,任务是判断谁是男谁是女。A 的目标是让 C 判断错,B 的目标是帮 C 判断对。
然后关键一步:让机器接替 A 的位置。衡量标准是相对的——机器骗过审问者的频率,是否不低于人类男性做同一件事的频率。
打字这个界面是刻意的:它把外形、声音、动作全部隔离,只留下”答得像不像”。
回访:这为什么不是”定义了智能”
图灵从没说通过这个游戏就等于会思考。他给的是一个可以做的实验,替代一个无法做的争论。
这也解释了为什么它常被误称为”图灵测验”并被当成一条判据:Turing test 这个词在原文里出现 0 次,通过标准也一个都没有。原文只有一个五十年后的经验预测。
边界与常见误解
**流行版本改了设定。**今天说的”图灵测验”通常是机器 vs 人、判断谁是机器。原始版本是机器接替一个正在假装女人的男人,基准线是人类模仿者的成功率。
**它测的可能不是智能。**French 1990 论证它实际测的是”是否拥有人类的亚认知联想结构”,即一种文化成员资格测验。Block 则用”查表机”指出:一台预存所有对话的机器可以通过,却显然不智能。
**通过它不代表理解。**这正是中文屋要攻击的地方。
提到这个词条的文章
- 计算机器与智能逐节拆解经典拆解 2026-07-31