根據卡內基美隆大學、麻省理工學院、牛津大學和加州大學洛杉磯分校研究人員的一項新研究,即使僅使用 AI 聊天機器人十分鐘,也可能對人們的思考和解決問題能力產生驚人的負面影響。研究人員透過一個線上平台,要求參與者解決各種問題,包括簡單的分數計算和閱讀理解,並為他們的工作支付報酬。

他們進行了三項實驗,每項實驗都有數百人參與。部分參與者可以使用能夠自主解決問題的 AI 助理。當 AI 助手突然被移除時,這些人明顯更容易放棄問題或答錯答案。這項研究表明,AI 的廣泛使用可能會以犧牲基礎解題能力為代價來提升生產力。麻省理工學院助理教授、參與這項研究的 Michiel Bakker 表示:「這項研究的重點並非我們應該在教育或職場中禁用 AI。」

「AI 顯然可以幫助人們即時表現得更好,這很有價值。但我們應該更謹慎地思考 AI 提供何種幫助,以及何時提供。」我最近在麻省理工學院校園裡見到了 Bakker,他有著一頭蓬鬆的頭髮和燦爛的笑容。他來自荷蘭,曾於倫敦的 Google DeepMind 工作。

他告訴我,一篇關於 AI 可能隨時間削弱人類能力的知名文章啟發了他,讓他思考這項技術如何已經在侵蝕人們的能力。這篇文章讀起來有些悲觀,因為它暗示這種能力削弱是不可避免的。儘管如此,或許找出 AI 如何幫助人們發展自身心智能力的方法,應該成為模型與人類價值觀對齊的一部分。

Bakker 告訴我:「這本質上是一個認知問題,關於堅持不懈、學習以及人們如何應對困難。」「我們希望將這些關於人機長期互動的廣泛擔憂,帶入受控的實驗環境中進行研究。」Bakker 表示,這項研究結果尤其令人擔憂,因為一個人堅持解決問題的意願對於習得新技能至關重要,也預示著他們長期學習的能力。

Bakker 說,可能需要重新思考 AI 工具的運作方式,使其能像一位優秀的人類老師一樣,模型有時會優先考慮個人的學習,而非直接為他們解決問題。Bakker 表示:「提供直接答案的系統,與那些提供鷹架、指導或挑戰使用者的系統,其長期影響可能大相徑庭。」

然而,他承認平衡這種「家長式」的方法可能很棘手。AI 公司確實已經在思考其模型可能對使用者產生的更細微影響。某些模型的諂媚傾向,或者說它們多麼容易同意並討好使用者,是 OpenAI 在新版 GPT 發布時一直試圖減輕的問題。當這些工具的行為可能不如預期時,過度信任 AI 似乎尤其成問題。

具備代理能力的 AI 系統特別難以預測,因為它們會獨立執行複雜任務,並可能引入奇怪的錯誤。這讓人不禁思考,Claude Code 和 Codex 對於那些可能需要修復它們所引入錯誤的程式設計師技能會產生什麼影響。我最近親身體驗了將批判性思維卸載給 AI 的危險。

我一直使用 OpenClaw(內含 Codex)作為日常助手,發現它在解決 Linux 上的配置問題方面表現出色。然而,最近我的 Wi-Fi 連線不斷斷線,我的 AI 助理建議執行一系列指令來調整與 Wi-Fi 網卡通訊的驅動程式。結果是我的機器無論如何都無法啟動。

或許,OpenClaw 不應該只是簡單地替我解決問題,而應該暫停下來教我如何自行修復這個問題。這樣一來,我可能會擁有一台能力更強的電腦,以及一個更靈活的頭腦。本文為 Will Knight 的 AI Lab 電子報內容。您可在此閱讀先前的電子報。