arXiv 预印本:近九成生物医学论文留有 AI 写作痕迹
新研究估算 2025 年 PubMed Central 论文 77% 显 LLM 痕迹,12 月单月近 90%,显著高于…
一项发布在 arXiv 上的预印本研究估算,2025 年 12 月某主要生物医学论文数据库中近九成的论文在文本中留下了 AI 辅助写作的痕迹,远高于此前的估计水平。该研究尚未经过同行评审,但其方法与结论已引发关于学术诚信与 LLM 使用的新一轮讨论。
核心数据与对比
研究团队分析了 PubMed Central 收录的全部 2025 年论文,估算其中 77% 显示出 LLM 使用痕迹,2024 年论文的这一比例约为 52%;进入 2025 年 12 月,单月比例进一步攀升至接近 90%。
这些数字显著高于此前的估计。同一作者团队 2025 年另一项仅基于摘要的研究给出 2024 年论文的 LLM 使用率下限为 13.5%;2026 年一项跨学科研究则估算 2025 年约 57% 的论文可能受到 AI 影响。比利时根特大学的计算机科学家 Dmitry Kobak 是本次预印本的合著者之一,他最初对结果持怀疑态度:「我确信我们哪里算错了。」但经过进一步验证,团队确认数据站得住脚。
方法差异推高比例
与多数既有研究类似,新工作也通过统计 LLM 常用词的出现频率来识别 AI 写作痕迹。Kobak 团队表示,本次使用的方法对 LLM 使用更敏感,能够给出 AI 使用的「直接估计」而非下限,这直接将 2024 年摘要的 LLM 使用率从 13.5% 提升至 31%。
研究者还指出,这一数字与 2025 年一项调查相吻合:71% 的受访研究人员承认使用 AI 辅助写作。作者认为,真实比例可能比调查中人们愿意承认或报告的水平更高。
不同章节差异明显
研究还发现,LLM 使用在论文各章节的分布并不均匀。2025 年 12 月的论文中,约 78% 的讨论章节显示出 AI 痕迹,而结果章节仅为 58%;摘要、引言和讨论部分的使用频率整体高于方法与结果部分。
Kobak 警告,AI 参与撰写结果章节尤其值得警惕,因为 LLM 容易「幻觉」出虚假数据;而让 AI 撰写或润色引言,则可能让模型的偏见渗透进整个学科的核心叙事。「LLM 可能带有的任何偏见,都会悄然扩散到文献中。」他说。
局限与反响
多位研究者在接受 Nature 采访时表示,新研究给出的高比例在 LLM 广泛使用的今天有其合理性,但同时也提醒,这些数字未必能代表整个科学文献的全貌,要全面理解 AI 在科研写作中的真实使用率,仍需更多分析。2026 年那项跨学科研究的作者、多伦多大学社会科学家 Kyle Siler 评价道:「牙膏已经挤出来了,不会再回去。」
