AI for Science

arXiv 重拳整治 AI 垃圾論文:未查核內容者禁投一年

2026 年 5 月中,arXiv 宣布對提交明顯未查核 AI 內容的作者處以一年禁令,解禁後投稿須先獲同儕審查場域接受。本文解析鐵證標準、處分程序與對預印本生態的影響。

arXiv 重拳整治 AI 垃圾論文:未查核內容者禁投一年 — 文章封面
本頁內容7 個段落
  1. 新規則:一年禁令與鐵證門檻
  2. 什麼證據會觸發禁令
  3. 處分程序與作者責任
  4. 前情:2025 年 10 月已先收緊評論文章
  5. 為什麼預印本平台別無選擇
  6. 對研究者的實際意義
  7. 參考來源

2026 年 5 月 14 日深夜,預印本平台 arXiv 的電腦科學分區主席 Thomas Dietterich 在 X 上宣布新規:凡是投稿內容出現「作者未查核 LLM 生成結果」的鐵證,作者將被處以一年禁投處分;解禁之後,新投稿還必須先獲得一個有聲望的同儕審查場域接受。The Verge 與 404 Media 均在 5 月 15 日報導。

這不是社群網站清理垃圾留言,而是全球科學傳播核心基礎設施的第一次明確懲罰機制。arXiv 過去以「不審查、只收錄」聞名,如今連它也承認:AI 生成內容的洪流,已經逼得平台必須劃出紅線。

新規則:一年禁令與鐵證門檻

新政策的觸發條件寫得很謹慎——不是「用了 AI 就禁」,而是「有不可反駁的證據顯示作者沒有查核 LLM 生成的結果」。Dietterich 的解釋直白:一旦作者連模型輸出都沒看過,「我們就無法相信論文裡的任何東西」。

處分本身分兩層:先是一年禁令;期滿後重新投稿,必須先通過正規同儕審查。換句話說,被禁一次,代價是永久失去「直接在 arXiv 發表」的便利。

什麼證據會觸發禁令

兩類「鐵證」被明確點名。第一是幻覺參考文獻——引用了不存在的論文。第二是留在正文裡的 LLM 對話殘留,例如「以下是 200 字的摘要,需要我做任何修改嗎?」,或者「表中的資料僅為示意,請填入你實驗的真實數據」。

第二類尤其難辯解:模型自己招認了輸出未經處理,作者照單全收。這些不是邊緣案例,而是審稿與閱讀時一眼可見的破綻。

處分程序與作者責任

程序上,先由 moderator 記錄問題,再經分區主席確認後才執行處分,而且作者可以申訴。Dietterich 特別強調政策只適用於鐵證等級的案例,避免誤傷正當使用 AI 輔助寫作的研究者。

責任歸屬也說得清楚:在論文上署名,就「對全部內容負完全責任」,無論內容是怎麼生成的。AI 代寫的抄襲、錯誤或誤導,都算在作者頭上。

前情:2025 年 10 月已先收緊評論文章

這次禁令有跡可循。2025 年 10 月 31 日,arXiv 就曾在官方部落格宣布限制電腦科學類的評論文章與立場文章,要求它們先通過會議或期刊的同儕審查。當時的理由是:大型語言模型讓這類內容「可以隨需大量生產」,而湧入的評論文章大多「只不過是註解式書目」。

從「限制文類」到「懲罰作者」,半年之內處分升級了兩級,背後是同一個壓力:AI 生成的材料正以「嚴謹科學」的名義大量湧入。

為什麼預印本平台別無選擇

arXiv 的價值建立在「快速、開放、不設審查門檻」上,這也是它當年擊敗紙本期刊時程的原因。但這個設計的前提,是投稿成本足以篩選出認真的研究者。當生成一篇「看起來像論文」的文字成本趨近於零,前提就崩塌了。同儕審查體系同樣被淹沒——審稿人面對的投稿量,已經超出志願體系能消化的範圍。

一年禁令是很重的處分,但比起付費牆或全面審查,這是 arXiv 能拿出、又最不傷害開放性的工具。

對研究者的實際意義

三個直接影響。第一,AI 輔助寫作沒有被禁,但「查核」變成硬性義務——每一條參考文獻、每一個數據表,送出前都要親自確認。第二,團隊合作要設最後一道關:任何一位共同作者留下的 LLM 殘留,全體署名者一起擔責。第三,對倚賴 arXiv 做優先發表(priority claim)的領域來說,被禁一年等於缺席一年的學術對話,風險遠大於省下的查核時間。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵