Over 30% of new ArXiv submissions now read as AI-written
14 hours ago
- 一项研究使用校准检测器,在ChatGPT之前的人类文本上具有0.4%假阳性率,测量了arXiv论文中AI撰写的文本比例。
- 约三分之一(32%)2023-2026年间的近期arXiv论文读起来像是机器撰写的,其中2026年初达到接近39%的峰值,显示出ChatGPT之后显著上升的趋势。
- 领域分析揭示了广泛差异:计算机科学以65%的检出率高居榜首,而数学仅为0.7%垫底,部分原因在于检测器对符号密集文本的识别限制。
- 研究局限性包括各领域控制样本量较小、检测器可能存在盲区(尤其在数学领域)、以及无法区分重度AI辅助与完全AI生成内容。
- 该检测器提供了AI采用率的下限估值;由于未能完全覆盖作者使用的多样化模型和提示词,报告中的普及率数据属于保守估计。