早在 ChatGPT 普及之前,教育工作者和編輯就經常使用反抄襲工具來檢查作者作品的真實性。這些工具透過將書面作品與網路內容、學術文章等資料庫進行比對,以檢查是否有匹配的句子和詞組。有些工具,例如 Turnitin,會提供一個百分比,聲稱能顯示學生寫作與其他作品的重疊程度。然而,由於潛在的誤報以及難以判斷作品是否故意複製,一些教育工作者已不再使用該工具。
然而,現在對複製內容的追查已演變成一場針對 AI 生成作品的戰爭。學生們迅速採用 ChatGPT、Google Gemini 和 Microsoft Copilot,教師們也同樣快速地採納了所謂的 AI 偵測工具。民主與科技中心的一項調查發現,在 2024 至 2025 年間,美國 43% 的六到十二年級教師經常使用 AI 偵測工具。
一些大學在其學習管理系統中已使用 Turnitin,發現該服務在 2023 年推出時自動啟用了 AI 偵測功能。
像 GPTZero、Pangram 和 Turnitin 開發的 AI 偵測工具,並非比對書面內容,而是依賴其自身的 AI 模型來猜測某段文字是否非人類所寫,這個過程甚至比網路文字比對更為模糊不清。正如 GPTZero 所指出,AI 偵測工具使用演算法分析文本的措辭、節奏和結構,並捕捉 AI 寫作中可能更常見的長度和語氣模式。
這種相對主觀的評估不如線上文字比對那樣可靠,且可能對以英語為第二語言的寫作者造成困擾。儘管如此,Turnitin 聲稱其 AI 偵測工具將人類寫作誤標為 AI 的比例低於 1%,而 Pangram 則稱其誤報率僅為萬分之一。GPTZero 也聲稱其將人類內容誤判為 AI 的比例同樣很低。
網路上人們已經開始互相指責對方「聽起來像 AI」,而 AI 偵測工具的普及只會助長這場大型語言模型(LLM)的獵巫行動。在一些備受矚目的案例中,AI 寫作的指控直接影響了人們的生計和聲譽。上個月,出版商 Minotaur 因擔心作者 Jerry Falade 使用 AI 而取消了一筆 200 萬美元的圖書合約,儘管他極力否認。
還有法國公民 Thierry Rignol,他去年起訴耶魯大學,因為一位教授指控他使用 AI 撰寫部分期末考,導致他不及格並被停學一年。該教授使用 GPTZero 掃描 Rignol 的寫作以尋找 AI 跡象,但訴訟指出「AI 監控和偵測工具已知會不公平地針對像 Rignol 這樣的非英語母語人士」。
今年二月,阿德爾菲大學的一名學生也贏得了針對學校的訴訟,此前他的教授同樣聲稱他使用 AI 撰寫論文。儘管訴訟中沒有說明教授使用了哪種 AI 工具來檢查學生的論文,但阿德爾菲大學與 Turnitin 簽有授權協議。
史丹佛大學 2023 年的一項研究發現,AI 偵測工具將非英語母語人士撰寫的論文誤標為 AI 的頻率高於英語母語人士。(許多服務仍聲稱其工具在處理非母語人士撰寫的文本時是準確的。)這些工具也可能對神經多樣性寫作者存在偏見。正如加州大學洛杉磯分校所指出,AI 偵測工具被訓練來識別可能表明 AI 使用的模式,例如重複的術語和詞組、聽起來過於正式或非正式的文本,以及無意義的措辭。
根據加州大學洛杉磯分校的說法,有些工具,例如 QuillBot,還會測量文本的「不可預測性」,因為「與人類寫作相比,AI 傾向於做出最『明顯』或最常見的語言選擇」。它們也可能將始終如一的句子結構視為 AI 的另一個跡象。然而,這些衡量標準本身並不能完全證明是 AI,因為有些人可能只是擁有這些特質的寫作風格。
儘管 Turnitin 宣稱其誤報率很低,但它仍堅稱其工具「可能不總是準確」,不應單獨用於對學生採取行動。Grammarly 警告用戶「絕不應單獨依賴 AI 偵測工具的結果」,而 GPTZero 則表示「沒有任何 AI 偵測工具能真正達到 100% 完美」。甚至 OpenAI 也因準確性低,於 2023 年關閉了自家的 AI 寫作偵測器。
然而,AI 寫作的指控仍在網路上四處流傳。上週,Ozzy Osbourne 的兒子 Jack 在一段向其超過 350 萬社群媒體追蹤者播放的影片中,指控記者兼 Verge 撰稿人 Kat Tenbarge 使用 AI 為 Rolling Stone 撰寫文章,並展示了 AI 偵測工具 Getsolved 的結果作為「證據」。
Tenbarge 已透過影片和網站貼文駁斥了這項指控,但 Osbourne 尚未撤回其指控或刪除影片,讓 Tenbarge 不得不應對網路酸民。從作家到學生,錯誤指控的例子不勝枚舉,許多指控者都未能意識到這些 AI 偵測工具附帶的免責聲明。
AI 偵測工具的不確定性,足以讓一些教育機構完全停止使用它們。耶魯大學、約翰霍普金斯大學、范德堡大學、喬治城大學等都已禁用或限制 AI 偵測工具的使用。麻省理工學院也警告說「AI 偵測工具無效」。
許多學校不再依賴工具來篩選 AI,而是鼓勵教育工作者重新思考他們的課程。例如,芝加哥大學建議學生放慢閱讀速度、將較長的寫作作業分段,並要求學生反思自己的作品。史丹佛大學表示教授可以考慮在課堂上進行評估,而麻省理工學院則建議教授為學生提供空間,讓他們在不受懲罰的情況下,披露是否在作業中使用了 AI 協助。
隨著 AI 在課堂內外日益普及,辨別內容是人類還是機器所寫的努力也隨之加劇。一些線上平台只會加劇對 AI 使用的疑慮。Substack 已將 Pangram 整合到其應用程式中,允許用戶掃描部落格中疑似 AI 生成的內容,而 LinkedIn 則在貼文上添加了「看起來像 AI 垃圾」按鈕。
結果是一個不信任的新時代,讀者不斷質疑他們所閱讀的內容是否為 AI 所寫,而真正的人類寫作者則盡力避免聽起來像 AI。
作者協會(Authors Guild)正透過提供「人類原創」(Human Authored)認證來幫助作家避免指控。此外,還有「非 AI 所寫」(Not by AI)和「人類撰寫」(Written by Human)的標章,用戶可以將其添加到線上作品中。維基百科也創建了一份指南,幫助編輯識別 AI 寫作,其中包括尋找「誇大」主題重要性或提供「膚淺資訊分析」的寫作。該網站也已禁止 AI 生成的文章。



