行為心理學

操作制約(operant conditioning)

操作制約,講的是我們如何從「行為的後果」中學習。當一個動作帶來好結果,我們就更願意去做;帶來壞結果,就慢慢不做了。想想一隻狗,一坐下就得到零食——牠便學會再次坐下,因為上回坐下「有賺頭」。

這套框架由美國心理學家史金納(B. F. Skinner)從1930年代起發展並命名,而它建立在桑代克(Edward Thorndike)更早提出的「效果律」之上——也就是「後果好的行為,往往會被一再重複」這個想法。史金納用的工具是一個小盒子,如今就叫史金納箱。箱裡的老鼠偶然碰到一根槓桿,掉出一顆食丸;沒多久,牠就開始有意去按那根槓桿了。獎賞重新形塑了牠的行為。其實我們都待在更大的「箱子」裡:工作的獎金、照片下的一個讚、遲到挨的一頓罵——每一個後果,都在悄悄撥動我們接下來怎麼做。

有一點常讓人弄混:強化和懲罰,看的是「行為變多還是變少」,而不是「那東西感覺舒不舒服」。此外,獎賞有個重要的「近親」叫逃避——一個能讓討厭的東西停下來的行為(例如吃片阿斯匹靈止住頭痛),被強化的力度,和能換來零食的行為一樣強。

幼兒在收銀台前哭鬧,家長買糖哄她安靜。糖強化了哭鬧,於是她下次哭得更兇——而家長的妥協,也被「孩子終於安靜」所強化。

後果會同時形塑雙方——強化是雙向流動的。

「operant(操作)」一詞是史金納所造,因為這種行為是「操作」環境、從而產生效果的。它與古典制約相對:後者只是反射被觸發,而在操作制約中,是動物先行動,世界再作出回應。

又稱
instrumental conditioninginstrumental learningSkinnerian conditioning工具性条件作用工具制約