一项针对arXiv论文的研究分析了12750篇论文文本,发现新论文中约三分之一呈现出明显的“机器写作”特征。
研究团队开发了一套针对学术写作优化的AI文本检测方法,并用ChatGPT出现前的论文进行校准,最后将误报率控制在0.4%。
随后,团队分析了2023年1月至2026年7月的arXiv论文,发现最近一个季度,被检测为“机器写作”的论文比例达到约32%,2026年初一度接近39%。
不同领域差异非常明显。
- 计算机科学领域最高,约65%的论文出现AI写作特征;
- 定量生物学约56%;
- 电子工程与系统约51%;
- 经济学与金融约47%。
- 而数学领域最低,仅约0.7%。
不过研究团队提醒,这并不代表数学论文几乎没人用AI。因为数学论文大量依赖公式、证明结构和特殊表达方式,检测模型对这种文本风格并不敏感,因此低比例可能来自检测能力不足。
同时,研究者强调,“检测到AI写作”并不等于“论文完全由AI生成”。
这类工具只能判断文本是否具有机器写作风格,无法区分AI辅助、AI润色等情况。
但趋势依然值得关注。
过去几年,AI已经从辅助科研工具,逐渐进入论文写作流程。从语言润色、结构调整,到摘要生成、实验描述优化,大模型正在改变科研人员产出文字的方式。
