基础
图灵测试(Turing test)
/ TOOR-ing test /
图灵测试是一个思想实验,用来绕开一个令人抓狂、滑不溜手的问题——「机器能思考吗?」——办法是把它换成一个你真能检验的东西。1950年,数学家阿兰·图灵提出:让一位人类裁判与两个看不见的对象用文字交谈,一个是人,一个是机器。如果自由聊过之后,裁判无法可靠地分辨谁是谁,那么就实用目的而言,这台机器已在对话行为上与人类持平。图灵把它称作「模仿游戏」。
他真正的高招是哲学层面的。与其没完没了地争论「思考」是什么意思、机器到底懂不懂,图灵说:让我们去衡量可观察的行为。如果它在对话中的表现与一个会思考的存在无从分辨,我们又凭什么否认它?这一重新框定——从内在本质转向外在表现——塑造了整个AI领域谈论「成功」的方式。
重要的是别给这个测试加戏。通过它,说明一台机器能逼真地模仿人类闲谈;它并不证明这台机器理解、有意识,或在任何深刻意义上是智能的。一个程序完全可以靠花招、回避和事先准备好的俏皮话来骗过裁判。批评者(尤其借由「中文房间」论证)指出:表现得像懂,并不等于真的懂。图灵测试至今仍是一个关于「证据与行为」的精彩而深具影响的想法——但它考的是模仿,而不是一张心智的证书。
裁判:「把34957加上70764。」一台天真的机器会瞬间、完美地报出答案——这反倒可疑得不像人。图灵指出,一台聪明的机器或许会停顿几秒,再答出「105621」(甚至故意夹带一个小错误),好让自己更像个人。这个测试奖励的,是对人类行为——连同那些小毛病——逼真的模仿。
出自图灵1950年的论文:表现得太完美,反而会暴露机器的身份。
通过图灵测试,意味着一台机器把人类对话模仿得足以骗过裁判——仅此而已。它是一项行为测试,并不能证明理解、意识或「真正」的智能。
又称
另见