arXiv 是一個廣為使用的開放預印本研究倉庫,正在採取更多行動來打擊科學論文中隨意使用大型語言模型的行為。雖然論文是發表在經過同儕評審之前,但 arXiv(發音為「archive」)已成為計算機科學與數學等領域研究傳播的主要途徑,網站也成為追蹤科學研究趨勢的重要資料來源。arXiv 已經採取行動來應對越來越多低品質、由 AI 產生的論文,例如要求首次投稿者必須獲得已建立作者的推薦。而在經過康奈爾大學主持超過 20 年後,這個組織現在正轉型為一個獨立的非營利機構,這應該會讓它有更多資金來處理像 AI 滥用這樣的問題。在最新動作中,arXiv 計算機科學部門主席 Thomas Dietterich 在週四發文表示:「如果投稿中包含無法辯駁的證據顯示作者未檢查大型語言模型生成的結果,這意味著我們無法信任這篇論文中的任何內容。」Dietterich 說,這類無法辯駁的證據可能包括「虛構的參考文獻」以及與大型語言模型的對話或評論。如果發現這些證據,論文作者將面臨「1 年內不得在 arXiv 投稿」,並需「在再次投稿前先獲得知名同儕評審期刊的採納」。需要注意的是,這並不是完全禁止使用大型語言模型,而是強調 Dietterich 所說的,作者必須「不管內容是如何產生的,都對內容負全責」。因此,如果研究人員直接從大型語言模型複製貼上「不當語言、抄襲內容、偏頗內容、錯誤、疏失、錯誤參考文獻或誤導性內容」,他們仍需為這些內容負責。Dietterich 告訴 404 Media,這將採用「一次過」的規則,但必須由監督者標記問題,並由部門主席確認證據後才能處罰。作者們也將有機會對此決定提出異議。最近的同儕評審研究發現,生物醫學研究中虛構引用的情況正在增加,這很可能與大型語言模型的使用有關;不過,必須公平指出,科學家並不是唯一會使用 AI 產生的虛構引用的人。
ArXiv 將禁止作者一年,若他們讓 AI 做所有工作
分享這篇文章: