老鼠的後設認知
原文由 Jacob Falkovich 于 發布,訂閱此部落格
老鼠的後設認知(名詞)
- 褐鼠(Rattus norvegicus)對自身心智內容的覺察,以及依據此覺察採取行動的能力。
- 理性主義者(Homo actually sapiens)對後設層次的覺察,以及無法抑止地想去思考它的渴望。
理性主義者培養的一項關鍵技能,是在不確定性下做決策。而要做到這點,就必須能夠評估自身的不確定性。而根據 Stanislas Dehaene 在《Consciousness and the Brain》中的說法,評估自身的不確定性,正是需要有意識取用的特定心智運作之一。
我們可以知道一些自己並未意識到的事情,例如猜測在螢幕上一閃而過、短到無法進入意識的數字是高於 5 還是低於 5,而且猜對率會高於隨機水準。但我們不知道自己究竟知道了什麼、也不知道自己有多確定。以上述閃現數字的例子來說,如果刺激未抵達意識,我們就無法估計自己在哪幾次試驗中比較可能猜對。
這段內容出自 ACX 上一篇對《Consciousness and the Brain》的客座書評。根據該書評,評估自身信心的能力並非人類獨有,顯然老鼠也有!這是否意味著囓齒動物是有意識的、並能覺察自身思考?還是說,書評所連結的那篇研究論文,結果會是一團有趣的混亂,讓人根本無法得出任何結論?
無論如何,我被吸引到去細讀了 Allison Foote 與 Jonathon Crystal 所著的Metacognition in the Rat (2007)。除非另有說明,以下圖表與引文皆出自該論文。

(老鼠圖片為 DALL·E 2 生成,由 @thinkwert 提供。如果 OpenAI 有人在看這篇,拜託拜託、頭上打個蝴蝶結拜託,可以給我 DALL·E 2 的使用權限嗎,這樣我就不用去求我的 Twitter 互關了?想想看,在我們全都滅絕之前,我能做出多少精美插圖的文章啊!)
Foote 與 Crystal(以下簡稱 F&C)訓練老鼠將聽到的噪音分類為短音(低於 4 秒)或長音。噪音長度介於 2 到 8 秒之間,越接近分界點(3.6 秒與 4.4 秒)的越難分類,越接近 2 秒或 8 秒的則越容易。老鼠若猜對就能獲得獎勵,有時牠們也能選擇放棄作答,以換取較少但保證能拿到的獎勵。
假設是這樣的:如果老鼠在較難的試驗(對聲音分類較不確定時)比在較簡單的試驗中更常選擇放棄,那就表示牠們能覺察到自身的不確定性。

F&C 為實驗畫了一張精美的示意圖,找來了八隻可愛的老鼠,然後……好消息就到此為止了。
不知為何,F&C 對猜對的老鼠給 6 顆飼料丸,而選擇放棄的只給 3 顆。如果比例是 5:3,老鼠至少要有 60% 的把握確定自己分類正確,選擇去猜才划算。但在 6:3 的情況下,老鼠根本沒有任何理由選擇放棄,就算牠幾乎是亂猜也一樣,因為 6 顆的 50.1% 就已經超過 3 顆了。試驗連續重複許多次,抹平了任何「風險」,而且無論如何
有證據顯示,老鼠在類似我們的情境中是傾向冒險的
那麼,老鼠在這場關於下注理性的簡單測試中表現如何呢?
五隻老鼠很少選擇放棄時長測試(M = 97.8%,SEM = ± .01%)。這五隻老鼠的表現很可能是反應偏誤所致,因為牠們似乎未能學會鼻觸孔的實驗關聯。因此,這五隻老鼠並未提供支持或反對後設認知的證據。
我不知道這些老鼠是不是真的「沒學會」什麼。看起來牠們倒是學會了:永遠不放棄作答,就能讓拿到的飼料丸數量最大化,就這樣而已。
那另外三隻呢?

X 軸代表測試的難度,最簡單的(2 秒、8 秒)在 2.00,最難的(3.6 秒、4.4 秒)在 1.00。右欄顯示答對的比例。在這裡我們看到一個令人困惑的結果:即使是很少在困難測試中選擇放棄的老鼠,在有放棄選項時答對率有 75%,但在沒有放棄選項的「強制」試驗中,答對率卻只略低於 50%!
難道老鼠只是因為少了「放棄」選項就方寸大亂(儘管有三分之一的試驗本來就是如此),以至於完全忘了哪個槓桿是做什麼的?是實驗者在操作上搞砸了什麼嗎?還是這三隻老鼠根本就是醉了,才會連「永遠不該放棄」這麼簡單的事都搞不懂?F&C 對這個結果隻字未提,希望你也不會注意到。

左欄顯示那三隻偶爾會放棄作答的笨老鼠的「放棄」率。將牠們的結果與另外五隻合併後,放棄簡單與困難測試的完整結果如下:
- 簡單測試:0%、0%、0%、0%、0%、0%、40%、20%
- 困難測試:0%、0%、0%、0%、0%、15%、70%、45%
這算是……有點東西?算是個結果?還是邀請大家用更多老鼠、更好的設計重做一次實驗?至於 F&C,他們倒是宣布後設認知獲勝了,因為那三隻老鼠確實在困難測試中比在簡單測試中更常放棄。他們甚至還貼上了一個 p<.05,雖然就列出的結果來看,我很好奇他們在計算 p 值時究竟假設了什麼分布。不管這些老鼠身上發生了什麼,那絕對不是常態分布。
但對這篇論文來說,最糟的消息還不是糟糕的設計、不是 62.5% 的受試者因為太聰明而被剔除、不是剩下三隻老鼠之間巨大的變異、不是強制試驗中約 50% 的猜測正確率、也不是那個與其說是分析、不如說是咒語般被召喚出來的 p 值。最糟的是,這一切根本無法證明任何關於後設認知的事情。
研究人員把聲音分類為長或短,但這不代表老鼠也得這麼分。我可以提出一個替代模型,在其中老鼠把聲音分成三類,每一類都對應一個不需要任何後設認知的行為:
- 短音(2–3.5 秒)-> 按左槓桿
- 中音(3.5–4.5 秒)-> 放棄作答
- 長音(4.5–8 秒)-> 按右槓桿
(這是針對那三隻偶爾會放棄的老鼠,另外五隻則只有「短」和「長」兩類,同樣不需要後設認知。)
我的替代模型比研究人員自己提出的模型,能好得多地解釋實驗結果。
第一,它解釋了為什麼那三隻老鼠偶爾會在簡單和相當簡單(難度 1.75)的測試中選擇放棄,即使牠們在強制測試中幾乎從未答錯這些題。老鼠絕不會把短音(2 秒或 2.44 秒)跟長音(4.4 秒以上)搞混,但牠們偶爾可能會把它誤認為中音(3.6 秒),因而放棄作答而不是去按左槓桿。研究人員的模型無法解釋,為什麼在被迫選擇時簡單測試答對率高達 95% 以上的 2 號鼠,會至少有一半的時間選擇放棄作答(以及那 3 顆飼料丸)。
第二,我的模型可以解釋為什麼老鼠在困難的強制測試中正確率只有約 50%。在聽到(中)音後,牠們判斷那是中音(沒有任何後設認知資訊,例如「這個聲音有某個機率其實是短音而非中音」)。當發現自己沒有放棄的選項時,一隻只知道自己聽到中音的老鼠,就只能在長音和短音的槓桿之間隨機選擇。
我的解釋在說明整體實驗結果上做得好太多了,它的缺席讓人不禁懷疑起老鼠研究人員的後設認知能力……

公平地說,該領域的其他研究人員最終也注意到了行為主義的替代解釋。Foote 與 Crystal 則以再找來八隻老鼠來回應,採用了一個更複雜的設計,讓老鼠可以按壓一個槓桿來重聽聲音。
用他們自己的話來說,結果是:
後設認知、而非替代性的非後設認知模型,預測受試者在被迫重聽刺激時的困難時長正確率,會高於受試者自行選擇重聽刺激的試驗,這一模式在我們的資料中確實被觀察到。對非後設認知模型的模擬顯示,老鼠資料的這一部分與後設認知一致,但資料的其他面向則與後設認知不一致。目前的結果對先前認為老鼠具有後設認知能力的研究發現提出了質疑。儘管這種混雜的資料模式並不支持老鼠具有後設認知,我們相信此方法的引入對於在其他物種上進行測試、協助評估後設認知的比較性證據,仍可能具有價值。
換句話說:「我們有些結果顯示老鼠有後設認知,有些沒有,有些甚至與先前支持後設認知的結果相矛盾。總結來說,整個設計對於研究老鼠的後設認知完全沒用,但如果你們再給我們更多補助經費,我們可以拿鴿子之類的來試試。」
這 100% 是正確的結論,我為研究人員的誠實鼓掌。

最後還有一個讓我好奇的問題:非鼠類的人類身上是否存在後設認知?我會認為,如果我們僅僅把後設認知衡量為對特定命題自身不確定性的覺察,答案可能不像你想的那麼直截了當。
以下是理性主義者會如何運用對自身不確定性的覺察:
- 做貝氏數學,依賴主觀機率的概念。
- 在做出陳述之前,先說明自己的認識狀態。
- 熱愛對任何事情下注,並參與預測市場。
- 在比特幣、COVID 以及許多其他情況下走在趨勢之前——那些機率低於 50% 的事件,基於期望值仍值得提前準備。
以下是非鼠類人類傾向於做的事:
- 當個頻率論者,堅持機率是大樣本(要多大?)相似(要多相似?)試驗集合的屬性,而不是擁有不完整資訊的心智的屬性。
- 一臉「認識狀態到底是什麼鬼?」的樣子。
- 拒絕對任何事下注,並對預測市場抱持懷疑。
- 忽略所有機率在 0–49% 之間的事情(把川普和俄羅斯入侵烏克蘭也加入上述清單作為例子),直到它成為現實,然後在那時堅稱事情本來就不可能有其他結果。
簡言之,理性主義者傾向於對許多命題表達經過仔細量化的不確定性,並據此行事,而非鼠類似乎對於一個命題 P 只處於以下三種認識狀態之一:
- P 是不可能的,貨真價實的 0%
- P 是完全不可知的,在不確定性解決之前別叫我下注或做任何決定
- P 是 100% 確定的
你可能會覺得,非鼠類人類顯然擁有後設認知。但你上一次實際看到有人表現得比老鼠好,是什麼時候呢?
隨機一篇部落格
留言
登入後參與討論