學生用ChatGPT等代勞寫作,引發不少爭議。更多人擔憂,聊天機器人已經滲透到學術場域中,這代表我們人類知識文明的前沿,正在受AI把持。
去年,一篇附有奇怪的期刊論文被下架,成為學術界憂心AI入侵的最新例證。
在那篇論文中,充斥著毫無意義的AI生成圖像,其中包括亂碼文字和一張嚴重錯誤的老鼠生殖器官示意圖。

「如果這些拙劣的插圖和數據能夠這麼輕易地通過同儕審查,那麼看起來更逼真的AI內容很可能已經滲透到科學文獻中,」為生物學家,科學誠信顧問比克(Elisebath Bik)直言。
近期,《科學進展》期刊一項由德國圖賓根大學研究人員發表的新研究證實了比克的疑慮:大量科學論文可能是在AI聊天機器人的協助下完成的。
研究團隊首先鎖定了454個聊天機器人「過度使用」的詞彙——在2022年ChatGPT推出後,這些「AI腔」的詞語開始以異常的頻率出現,在此之前則無人問津。
他們進一步以這454個詞彙,分析學術期刊資料庫PubMed每年收錄的約1,500萬篇論文,發現有13.5%到40%的生物醫學論文摘要有「AI痕跡」。這意味著,至少有200萬篇論文摘要經手AI。
知名醫療中心BIDMC的AI計畫主任羅德曼(Adam Rodman)指出,考慮到一些論文可能經過人類有意編輯,刪掉AI腔,因此這個數字預估可能還算保守了。
AI協助產製論文,會怎樣?
圖賓根大學的研究人員提出,如果期刊中的AI腔摘要,真的代表研究多由AI代勞,可能會對生物醫學領域的科學寫作產生「前所未有的影響」,「衝擊將超越Covid-19等重大世界事件」。
比克也強調,「生成式AI將嚴重損害科學論文的品質、可信度和價值,」她以去年被下架的老鼠論文舉例,控訴現在的科學期刊在面對AI生成的「垃圾論文」方面是多麼「幼稚」,「甚至期刊編輯可能完全知情。」
近期,英國薩里大學的一份報告也警告,大量低品質的AI研究論文正在威脅科學知識本身。這些論文有大量公式化的研究過程,不洽當的研究設計,和帶有錯誤的研究結果。
最常見的毛病是「化繁為簡」。通常,像是憂鬱症、心血管疾病和認知功能障礙等問題,被認為是「多因素問題」,但現在這些健康狀況被當成簡單的「單因素問題」進行研究。
研究作者之一的斯皮克(Matt Spick)指出,「大量看似科學但經不起嚴格審查的論文,這是利用國家健康數據庫偽裝成科學事實的『科幻小說』。」
然而,對於「AI可以幫忙寫科學論文嗎?」科學家的想法有明顯的分歧。
《自然》期刊最近對5,000多名研究人員進行調查,詢問何時可以使用AI撰寫論文。
23%的《自然》受訪者表示,使用AI而不標明其協助是可以接受的;約45%的受訪者表示,只有研究人員揭露使用AI時才可以接受;最後,有33%的受訪者表示,這種做法絕對不可接受。
有些人認為,AI工具已經被廣泛應用,沒有必要特別揭露, 「AI將會成為一種常態,就像使用計算器一樣,」曼谷朱拉隆功大學的生物醫學研究員佩琪羅爾琳恩(Aisawan Petchlorlian)說;一位加拿大地球科學研究員則持相反意見,「我永遠不會容忍使用生成式AI來撰寫或審查論文的行為。」
對於德國圖賓根大學新論文中分析的AI撰寫摘要的情況,史丹佛大學人工智慧醫學教育主任喬納森(Jonathan H. Chen)說,「現在一切都很模糊,我們處在混亂的灰色地帶。」
(資料來源:Nature, Science, Futurism, NYT, VICE)