學生現在有多依賴AI完成作業和考試?
美國密西西比州艾爾康州立大學的歷史學教授吉布森(Jason Gibson)設計了一個巧妙的陷阱。他在期中考的考卷指示中,用白色字體隱藏了一段文字,要求AI模型在回答時加入與「馬達加斯加」相關的無意義內容。
結果,這份關於「工業革命」的考卷,學生的答案中出現了各種令人啼笑皆非的句子,例如「馬達加斯加在下午側著身子漂浮」、「馬達加斯加紫色腳踏車對著天花板低語」。
這意味著,懶惰的學生直接複製貼上到AI聊天機器人,再把產生的內容原封不動貼回考卷。
「兩個班級共35名學生中,有32人在期中考的某個部分不及格,因為他們全都是用AI生成整篇答案,」吉布森在TikTok影片中無奈地表示,「而且很顯然,他們連檢查都沒檢查。」
吉布森強調,他設計陷阱並不是為了羞辱學生,而是希望藉此讓學生反思,「我並不以看著學生不及格為樂,那很奇怪,」他說,「我們都不知道在學術界該如何應對AI,大家都只是在努力維持某種程度的學術誠信。」
誠信危機,蔓延常春藤名校
吉布森的考試並非單一個案。近期,布朗大學經濟學教授羅塞拉諾(Roberto Serrano)在春季的福利經濟學期中考,首次採用了「帶回家考試」的形式。
結果,原本平均分數在65到80分之間的考試,這次的平均分數高達96分。
塞拉諾察覺事有蹊蹺,將試卷輸入ChatGPT進行測試,發現學生的答案與AI生成的內容高度相似,甚至連解題邏輯都如出一轍。
他隨後將期末考改為實體考試,結果平均分數暴跌至48.6分,創下歷史新低,更有近20名學生不及格或退選。
「我們不能容忍,社會中有一大部分最聰明的年輕人認為作弊是可以接受的,」塞拉諾沉痛地說,「我們不能選擇讓自己變成白痴。」
甚至連擁有133年歷史、以榮譽制度聞名的普林斯頓大學也無法倖免。《大西洋》報導,自1893年以來,普林斯頓的期末考一向沒有監考人員,全憑學生簽署不作弊的誓言。
但在AI作弊氾濫的壓力下,校方不得不於近期宣布重啟監考制度,「只要大家認為作弊的情況愈來愈多,就會鼓勵更多人作弊,」普林斯頓大四學生馬庫克(Nadia Makuc)表示。
學力滑落:重新擁抱標準化測驗?
學生濫用AI不僅是學術誠信危機,也讓他們的基本學力日益下滑。
近期,超過1100名加州大學系統的數理科教授發表公開信,呼籲校方恢復大學入學的標準化測驗(如SAT、ACT)。信中指出,學生的準備程度出現「嚴重的落差」,在加州大學柏克萊分校修讀第一學期微積分的學生中,近三分之一「顯示出嚴重的準備不足」。
「我們現在觀察到的準備落差非常嚴重,以至於講師必須重新教導國中數學,同時還要教授學生在科學、工程、經濟學等領域所需的內容,」教授們在信中寫道。
事實上,近年來有超過九成的大學出於公平性考量,取消了強制的標準化測驗,但面對學生明顯下降的學力,麻省理工學院、達特茅斯學院以及耶魯大學)等頂尖學府,已紛紛恢復了入學測驗,以更準確地評估學生程度。
教育的本質:如何確認學生真的學到了?
當AI能在幾秒鐘內生成高分的文章或解題步驟,教育工作者面臨的深層問題是:如何確認學生真正學到了知識?
威斯康辛大學斯托特分校助理教授德雅格(Brett DeJager)針對教育工作者的調查顯示,除了學術不端,有超過半數的受訪教師對於「在使用AI時難以評估學生學習狀況」感到擔憂。
許多教師已經開始嘗試使用AI檢測工具,但這些工具的誤判率極高。
德雅格建議,教育工作者需要更有意識地設計每一項作業的評量目標。
如果目標是寫作流暢度,或許需要讓學生在課堂上手寫;如果目標是閱讀理解,則可以要求學生口頭解釋,或為自己的想法辯護。
更重要的是,學校必須制定明確的AI使用政策。例如有些作業可以完全禁止使用AI,以評估獨立寫作能力;有些則允許使用AI進行腦力激盪,但要求提交原創筆記;此外,也可以讓學生評論AI生成的答案,指出其優缺點。
「我們的目標不是抓出每一次濫用AI的情況,這是不可能的,」德雅格總結,「重點是指派的任務必須能回應:這個學生到底理解了什麼?」
(資料來源:Alantic, WSJ, IHE)