別太相信AI能抓AI|專家論點【張瑞雄】
作者:張瑞雄(台北商業大學榮譽講座教授)
學生交來一篇文章,老師懷疑是AI寫的,丟進AI偵測工具,螢幕跳出「AI生成的機率85%」,學生就算作弊嗎?

AI偵測工具的創辦人都承認,達到100%的正確率大概做不到。連賣偵測工具的人都不敢保證,學校怎麼敢把一個百分比當判決書?
誰寫的?
AI文字偵測有先天困難,今天AI愛用的句型,明天新版可能就消失。人類發現AI愛用破折號,告訴ChatGPT不要用,它馬上可以改。網路上甚至出現專門替AI文章「人性化」的工具,抓的人永遠追著寫的人跑。
OpenAI自己就是很好的例子,2023年曾推出AI文字偵測器,結果只能辨識出26%的AI文章,還把9%的人類文章誤判成AI,幾個月後乾脆下架。
3年過去了,技術當然進步很多。一個軟體宣稱在AI文字超過20%的文件中,誤判率低於1%。聽起來已經很好,但1%放進100萬名學生,就可能有1萬名學生被冤枉。所以軟體公司也很小心,偵測比例低於20%時,乾脆不顯示確切百分比,因為容易誤判。它還明白提醒學校,AI偵測結果不能單獨作為處分學生的依據。工具公司都叫老師不要太相信工具,老師更不該迷信。
好學生倒楣?
一個英文寫得很棒的學生,句型規律、文法幾乎沒有錯,可能比較像AI。一個英文程度不好的學生,拼字錯誤、文法亂七八糟,反而很有「人味」。如果最後前者被懷疑作弊,後者順利過關,是不是開了一個很大的玩笑?
非英語母語學生更值得注意,很多AI偵測器主要用英文資料訓練,語言能力、文章類型、篇幅都可能影響結果。連OpenAI當年的分類器都承認,在非英文文字上的表現更差。
還有一個灰色地帶,學生自己寫初稿,叫AI改英文,算誰寫的?學生寫中文,請AI翻成英文呢?自己列大綱,AI幫忙整理句子又怎麼算?今天的文章很少只有「100%人寫」與「100%AI寫」兩種,AI輔助寫作愈普遍,硬要把每篇文章貼上人類或AI標籤,會愈來愈困難。
老師用心才是正途
老師一次改50份報告,不可能每篇都當刑警辦案。偵測器可以幫老師找出值得注意的文章,就跟抄襲比對系統一樣,有紅燈就多看兩眼,可是有紅燈不等於有罪。
老師如果懷疑學生大量使用AI,最簡單的方法是把學生叫來談。你為什麼選這個題目?這一段在講什麼?資料從哪裡來?把其中一個觀點再說清楚。真的自己寫過的人,通常講得出思考過程。
更好的方法是看過程。學生留下大綱、資料來源、初稿、修改紀錄與AI對話,老師看到的是作品怎麼長出來。大學也可以增加口試、課堂寫作、專題實作與簡報答辯。這些方法比較麻煩,卻比盯著「AI生成73%」來做判斷公平。
AI已經進入職場,學校若還把「完全不用AI」當成規定,也會碰到麻煩。學生畢業進公司,老闆可能第一天就叫他用AI來提高效率。
老師規定不能用AI,學生偷偷叫AI整篇代寫,當然要處理。老師准許用AI整理資料,學生清楚交代怎麼使用,就沒有必要抓。每一門課先把界線講明白,比事後拿偵測器追殺有效得多。
學生用AI寫作,老師再用AI決定學生有沒有作弊。教育如果走到這一步,最該被檢討的恐怕不是學生,不用大腦的老師和學校才是罪魁禍首。
延伸閱讀:AI開始不聽話,人類準備好了嗎?|專家論點【張瑞雄】
![]()





