人工智能即使給出錯誤答案,仍可能顯著提高使用者的自信,並削弱其承認「不知道」及暫緩判斷的意願。法國與意大利多所大學研究人員發現,獲得AI建議後,受試者不但更容易重複錯誤資訊,回答準確率亦明顯下降。

研究人員發現,獲得AI建議後,受試者不但更容易重複錯誤資訊,回答準確率亦明顯下降。 (AI生成圖片)
研究由米蘭比可卡大學副教授Valerio Capraro、法國高等師範學院Chiara Marcoccia,以及羅馬第一大學Walter Quattrociocchi共同進行,旨在了解AI如何影響人們認知自身知識局限的能力。
Capraro表示,能夠承認「我不知道」是批判思考的重要部分,代表人們意識到自己掌握的資訊不足。然而,生成式AI讓使用者幾乎可即時取得任何問題的答案,研究團隊因此關注,這是否會降低人們暫緩判斷的意願。
研究人員設計了一系列大型語言模型不易正確回答的問題,內容主要涉及電影中的視覺細節,例如角色駕駛的車輛類型、球隊球衣顏色等。這些資訊通常較少出現在模型訓練資料中,實驗使用的Step 3.5 Flash亦經常給出錯誤答案。
受試者被分為兩組,一組在沒有AI協助下作答,另一組可向AI尋求建議。結果顯示,沒有AI時,44%的受試者選擇回答「不知道」;獲得AI建議後,這一比例大跌至3%,反映人們暫緩判斷的能力幾乎消失。
AI未能提高準確率
AI協助亦未能提高準確率。沒有AI時,27%的受試者答對問題;使用AI後,正確率反而降至9%。研究人員認為,部分原本可能依靠自身記憶答對的參與者,在接收AI錯誤建議後改變答案。
更值得關注的是,受試者的自信程度與準確率呈現相反走勢。沒有AI協助時,參與者認為自己答對的比例約為30%;使用AI後,這一比例升至76%。換言之,受試者的正確率降至原來約三分之一,但自信程度卻增加逾一倍。
研究團隊其後引入金錢獎勵,希望鼓勵參與者重視準確性並更謹慎作答。結果雖略有改善,回答「不知道」的比例由3%升至8%,正確率由9%增至16%,但仍明顯低於沒有AI 協助時的44%及27%。
研究人員指出,儘管實驗問題集中於電影細節,但相關結果可能適用於更多日常及專業場景。當AI以流暢、肯定的語氣提供答案時,使用者可能難以辨別資訊是否可靠,甚至把模型的自信表述誤認為準確性。
Capraro認為,改善模型固然重要,但科技公司未必有足夠誘因主動降低使用者依賴,因此更可行的方向是在教育制度中加強AI素養及批判思考訓練,教導使用者核實來源、評估不確定性,並保留說「不知道」的能力。
他尤其關注生成式AI對兒童的長期影響。成年人過往已透過教育及生活經驗建立一定的判斷能力,但從小與AI系統共同成長的兒童,可能在尚未形成批判思考習慣前,便習慣直接接受機器提供的答案,增加日後無法獨立判斷資訊真偽的風險。