基礎
圖靈測試(Turing test)
/ TOOR-ing test /
圖靈測試是一個思想實驗,用來繞開一個令人抓狂、滑不溜手的問題——「機器能思考嗎?」——辦法是把它換成一個你真能檢驗的東西。1950年,數學家艾倫·圖靈提出:讓一位人類裁判與兩個看不見的對象用文字交談,一個是人,一個是機器。如果自由聊過之後,裁判無法可靠地分辨誰是誰,那麼就實用目的而言,這台機器已在對話行為上與人類持平。圖靈把它稱作「模仿遊戲」。
他真正的高招是哲學層面的。與其沒完沒了地爭論「思考」是什麼意思、機器到底懂不懂,圖靈說:讓我們去衡量可觀察的行為。如果它在對話中的表現與一個會思考的存在無從分辨,我們又憑什麼否認它?這一重新框定——從內在本質轉向外在表現——塑造了整個AI領域談論「成功」的方式。
重要的是別給這個測試加戲。通過它,說明一台機器能逼真地模仿人類閒談;它並不證明這台機器理解、有意識,或在任何深刻意義上是智能的。一個程式完全可以靠花招、迴避和事先準備好的俏皮話來騙過裁判。批評者(尤其藉由「中文房間」論證)指出:表現得像懂,並不等於真的懂。圖靈測試至今仍是一個關於「證據與行為」的精彩而深具影響的想法——但它考的是模仿,而不是一張心智的證書。
裁判:「把34957加上70764。」一台天真的機器會瞬間、完美地報出答案——這反倒可疑得不像人。圖靈指出,一台聰明的機器或許會停頓幾秒,再答出「105621」(甚至故意夾帶一個小錯誤),好讓自己更像個人。這個測試獎勵的,是對人類行為——連同那些小毛病——逼真的模仿。
出自圖靈1950年的論文:表現得太完美,反而會暴露機器的身份。
通過圖靈測試,意味著一台機器把人類對話模仿得足以騙過裁判——僅此而已。它是一項行為測試,並不能證明理解、意識或「真正」的智慧。
又稱
另見