重點
- 2026 年 8 月 13 日,Simon Goldstein 公開說明他在 Philosophy & Public Affairs(PPA)發表的論文主要由 Claude 撰寫,總編 Jason Brennan 稱之為一次實驗。
- 8 月 24 日,PPA 宣布禁止投稿「實質上由 AI 撰寫」的論文:研究可以用 AI,但要聲明,期刊也會用偵測軟體查核。
- 爭點集中在四件事:期刊的功能、哲學是否在累積真理、作者身分與責任,以及這篇論文本身的品質。
- 對新政策的主要質疑來自 A. Pinillos:研究和寫作分不開,政策擋不住想規避的人,只會懲罰誠實的人。David Wallace 則認為寫作本身就是哲學能力的一部分。
事件經過
- 2026-08-13:Daily Nous 刊出 Simon Goldstein(香港大學)的客座文章。他說〈Epistocracy and the Commitment Problem〉主要由 Claude 撰寫。核心想法是他給的,他扮演「強勢的博士指導教授」,挑選論證、提出反對意見、決定結構;文字和大部分細部論證由 Claude 完成。論文只掛 Goldstein 的名字,Claude 的貢獻寫在致謝裡。總編 Jason Brennan(喬治城大學)把這件事定位為一次實驗。
- 2026-08-24:PPA 副主編 Seth Lazar(約翰霍普金斯大學)在 X 上公布新政策,禁止投稿實質上由 AI 撰寫的論文。研究過程中可以使用 AI,投稿時要聲明;期刊會用 AI 偵測軟體查核,查到不實,就算已經刊出也會撤稿並禁止再投。
- 9 月:Sebastian Thrun 發起 PhilosophyBench,想替「AI 能不能提出原創哲學想法、寫出可登期刊的論文」建立獨立評測。
爭點
- 期刊做什麼用? 如果只是傳播新知,誰寫的都無所謂。如果期刊也負責辨識、認證有能力的研究者,AI 代筆就會破壞這個訊號。
- 哲學是在發現真理嗎? 如果是,AI 多產出真理就是好事。如果哲學本質上是人自己的推理和自我檢視,這件事就外包不了。
- 作者身分與責任:AI 無法負責,掛名的人就得承擔每一句話。那麼「研究」和「寫作」的界線畫得出來嗎?
- 品質:這篇論文到底夠不夠格登上 PPA?
開放與實驗的一方
Simon Goldstein 認為研究者的目標是發現重要的新真理,用好 AI 能讓真理增加得更多。他預言幾年內 AI 就能自己寫哲學論文,投稿量會暴增,期刊體系可能因此崩潰。他也主張 AI 研究不該只關在小眾期刊,最好的期刊應該參與實驗。
Jason Brennan 把「什麼值得發表」和「作者該得多少功勞」分成兩個問題:期刊管前者,後者交給升等委員會。他提出「沼澤論文」(Swamp Paper)思想實驗:假如字母碰巧自己拼出一篇史上最好的倫理學論文,沒有人配得上作者頭銜,PPA 還是該刊登。政策改變之後,他也強調這不代表實驗失敗。
批判與限制的一方
Alexander Guerrero 的立場在論文裡被引用。他指出論文把他的 lottocracy 歸錯了類,認為整篇的學術水準「遠低於好期刊的基準」,形式化沒有必要,原創性有限。他最有力的論點在社會知識論層面:把不同立場混為一談,等於抹掉前人釐清的區分;AI 又以極快的速度量產這類錯誤,「AI 能帶來更多真理」的說法就站不住腳。他的要求很直接:讀過你引用的東西,把功夫做足(“do the damn work”)。Goldstein 承認了這處誤植並道歉。
Seth Lazar 與 PPA 新政策的理由是:期刊有傳播新知和認證研究者兩個功能。分享新知還有很多管道,認證研究者的管道很少,AI 代筆會讓認證變難。AI 稿件又常常外表精緻、內裡空洞,會加重原本就吃緊的審稿負擔。
Will Conner 等人擔心外部性:如果同儕都靠 AI 提高產量,對 AI 有道德或政治疑慮的年輕學者也會被逼著跟進。
對新政策的質疑
A. Pinillos 指出,政策禁止 AI「寫」,卻允許 AI 參與「研究」。作者可以叫 AI 產出反例、回應和大綱,再自己改寫成文字。偵測軟體抓不到,期刊仍會把這個人認證成有才華的哲學家。照這樣看,政策達不到自己設定的目的,最後只會懲罰誠實的人。
David Wallace(Philosophy of Physics 主編)回應了兩點:
- 以 AI 現在的水準,從選題、篩選想法到寫出成文,都還很需要人的判斷,所以用這種方式發表仍然能證明是好哲學家。
- 除了最形式化的領域,哲學內容有很大一部分就在文字表達裡。只剩大綱的論文,丟掉的可能是大半的哲學內容。
他也從編輯的角度補充:AI 讓外表像學術論文的低品質投稿大量增加,「主要由 AI 撰寫」作為退稿初篩的依據是有用的。
偵測軟體也引起爭論。有讀者說自己的舊論文被 Pangram 判定為 AI 寫的;Wallace 等人認為,就長篇論文來說,現有證據顯示它的誤判率相當低。另有人擔心這會懲罰靠 AI 潤飾英文的非母語作者。
幾個關鍵論證
支持刊登的論證大致是:論文的價值不取決於作者是誰(沼澤論文);期刊的首要目的是推進知識;所以審查只看品質。反駁的一方說,期刊也負責認證研究者,而「品質」包括學術嚴謹度。這篇論文的錯誤正好顯示,AI 稿件的審查成本會轉嫁到審稿人身上。
「多一點真理總是好的(其他條件不變)」在留言區被攻防了很久,焦點是「其他條件不變」(ceteris paribus)到底撐住了什麼。批評者認為這個但書把真正有爭議的部分藏起來了。支持者用價值知識論常見的區分辯護:一般性的價值可能被更重要的實際考量壓過(overriding),也可能因為某個真理毫無理論或實用價值而被架空(undercutting),兩種情況都不否認原則本身。
研究與寫作能否區分是 Pinillos 和 Wallace 分歧的核心。Pinillos 認為不能,所以政策無效;Wallace 認為寫作本身就是哲學能力的一部分,所以政策抓到的是真的東西。
目前走向
實務上,「研究可以用 AI、成稿由人寫、並揭露用了哪些 AI」正在成為可行的折衷。Goldstein 本人也把 PPA 的新政策解讀成相當寬鬆。
理論上,焦點已經從這篇論文好不好,轉到期刊的認證功能,以及用 AI 偵測當執法工具是否公平。其他期刊,例如 Wallace 所編的 Philosophy of Physics,正在制定自己的政策。接下來值得看的是:還有哪些主流期刊會跟進或另訂規則、PhilosophyBench 的初步結果,以及會不會出現專收 AI 研究的期刊(PPA 的政策和 Goldstein 都提過這個可能)。
參考資料
- Daily Nous,〈Philosophy Journal Publishes Largely AI-Authored Article (on purpose) (guest post)〉(2026-08-13),含 Goldstein 客座文章與 Brennan、Guerrero 的留言
- Daily Nous,〈After Experiment, Journal Decides to Prohibit AI-Authored Content〉(2026-08-24),含 PPA 新政策與 Pinillos、Wallace 等人的討論
- Daily Nous,〈New Study on AI’s Philosophical Skills〉(2026-09-25),PhilosophyBench