準確率砍到三分之一、信心翻倍:AI 建議讓人不會答對,卻更敢確定
一項由法國與義大利研究者進行的實驗量化了「AI 建議」對人類判斷的影響,數字相當難看:拿到 AI 建議的受試者,答題準確率從 27% 掉到 9%,只剩三分之一;對答案的信心卻從 30% 升到 76%,翻了一倍多。最極端的變化在「承認不確定」:願意回答「我不知道」的比例從 44% 崩跌到 3%——就算模型給的是錯誤答案,人們也幾乎停止承認自己不確定。
實驗設計的巧思在選題。研究者刻意挑 AI 模型普遍答不好的電影視覺細節題,例如《我愛貝克漢》裡球隊制服的顏色。用意很清楚:排除「把工作外包給更可靠的專家」的合理辯護——受試者跟隨爛建議,純粹因為建議「存在」而且「看起來權威」,與建議的品質無關。
研究由 Valerio Capraro 與巴黎高等師範學院的 Chiara Marcoccia、羅馬第一大學的 Walter Quattrociocchi 合作完成。結論指向 AI 搜尋與 AI 助理的介面設計:當模型用流暢自信的語氣輸出錯誤答案,使用者的批判性思考會被壓制,而現在的產品介面幾乎都在強化這種權威感。
歸剛點評:44% 到 3% 的「不知道」崩跌是整個研究最值得記的數字——AI 建議摧毀的與其說是準確率,倒不如說是說「我不知道」的能力。實際自保方法:把 AI 當同事而非當百科,問完答案追問「你的信心多高、依據是什麼」;做 AI 產品的人,把不確定性標示做進介面,是功德也是護城河。
歸剛點評|量化證據顯示 AI 建議會壓制人類承認不確定的能力,對 AI 搜尋產品的介面設計與使用者教育都有直接含義。