学术预印本重镇 arXiv 在2026年10月1日正式拉下物理限流闸门:每位研究者每个自然月最多只能提交2篇论文,且在任何时间点处于活跃状态的论文不得超过3篇。这项写在官方博文《Fair Moderation, Equitable Access, and AI: arXiv’s Updated Rate Limit Policy》中的临时新规,直接指向过去两年呈指数级涌入的 AI 生成垃圾论文与低质拆分稿件。

自1991年创立以来,arXiv 维系了长达35年的学术自由分享传统。平台不搞传统期刊繁重的同行评审,全凭全球学者组成的志愿审稿人进行底线范围把关。如今这套学术公地防御体系已被零成本的生成式文本彻底冲垮。面对无休止的排版洗稿与伪造数据,无偿劳动的志愿者心力已经耗尽,平台不得不选择最原始的配额管控手段。

arXiv 投稿量与运维负荷激增 2016年9月投稿量 9,869 基线阶段 · 纯学者手动撰写 2024年9月投稿量 20,569 生成式工具萌芽 · 8年翻倍 2026年9月历史天量 40,363 单月涌现近9,000个支持工单 工单量达投稿总量22% * 数据来源:arXiv 官方统计与支持系统记录

4万篇天量背后的cs.AI通胀与一年四次退守

单月投稿突破4万篇的数字固然骇人,但全站通胀并不等于全局失衡。

数据显示,arXiv 投稿量在2016年9月为9,869篇,2024年9月攀升至20,569篇,而到2026年9月直接冲上 40,363篇,两年间增幅高达约96%。然而细拆各个学科分类可以发现,真正的压力核心集中在人工智能子分类。过去约两年时间里,计算机科学全站投稿并非均匀翻倍,单单是 cs.AI 子集的提交量就暴涨了逾6倍。

面对这种定向泛滥,arXiv 在过去一年间几乎耗尽了常规规则武器,防线节节败退。

最初,平台在计算机科学板块全面停止接收综述与立场文件,试图堵住靠大模型自动拼接观点的口子。2026年1月,平台收紧准入门槛,取消了沿用多年的凭高校学术邮箱直接注册投稿机制,强制要求新作者必须获得已有资深作者的背书认可。到了2026年5月,管理层祭出更具威慑力的罚则:凡提交包含 AI 幻觉、虚构虚假参考文献或正文残留提示词指令的作者,一律封禁账号一年,解封后还需自费出具正规同行评审证明。

但这些震慑收效甚微。9月产生的近 9,000个支持工单 彻底压垮了运营后台。这批相当于当月投稿量22%的工单,充斥着审核申诉、状态催缴与技术排查,最终迫使顾问委员会主席 Thomas Dietterich 与管理团队动用最极端的全站限频手段。

arXiv 应对 AI 投机的一年防守路线 阶段一:裁减文类 停止接收计算机 综述与立场论文 阶段二:门槛加固 2026年1月 废除教育邮箱直通 强制老作者背书 阶段三:严刑惩戒 2026年5月 虚假引用/幻觉稿 一律封号一年 阶段四:物理限流 2026年10月 月限投2篇 活跃上限3篇

零边际成本的造纸机,如何压垮无偿的学术公地

这场危机的本质是生产力工具与治理结构之间的技术代差。大模型普及后,学术界发表或出局的晋升考核迅速被黑产与投机者工具化。

借助自动化工作流,撰写一篇形式工整、图表齐全但内容空洞的薄弱论文,或者把单个实验拆成数篇发布的切香肠论文,边际成本已经趋近于零。然而在消费端,甄别这些论文的成本却不降反升。每一篇看似规整的稿件,都需要人类审稿人花费半小时以上仔细核对公式推演、代码可用性与实验真伪。

零成本的生成式文本,正在消耗最稀缺的人类学者无偿时间。

Thomas Dietterich 坦言,极少数高频投递低质内容的作者霸占了过半审核精力,直接导致大量合规研究者的正规成果被积压数天甚至数周。arXiv 的生命线在于抢先发布权(priority),当论文在审核队列中动辄延误数周,预印本平台最核心的价值就已名存实亡。

这也暴露了依赖学术自觉维系的传统公地在生成式时代有多脆弱。arXiv 并不排斥辅助工具,官方准则依然允许使用生成式工具进行代码调试、数据整理与文字润色,但前提是必须完整披露且研究具备学术增量。遗憾的是,没有强身份认证与严密追责链条的预印本平台,根本无法用软性规则约束恶意滥用。


账号配额难防黑产,反将重创正规大课题组

把防线收缩到账户物理配额,是 arXiv 走投无路下的被动防御,但这道闸门在防住真正作弊者的同时,正引发合规科研社区的强烈反弹。

横向审视学术界的预印本与评审平台,各方治理路径分歧明显:

  • bioRxiv 紧盯实验安全性与学术伦理,严格审查生物安全与剽窃底线,但不对学者设投稿频次天花板;
  • SSRN 确立了明确的披露与作者自负全责模式,把精力放在造假调查与事后追责上,并未实施账户级限频;
  • OpenReview 作为顶会评审底层平台,则要求提交者必须为人类作者,将 AI 稿件的具体准入权下放给具体会议自行界定。
平台机制核心审核逻辑频次配额管制针对 AI 稿件核心手段
arXiv志愿专家底线粗筛单月2篇 / 活跃3篇封号惩戒 + 强制老作者背书 + 物理限频
bioRxiv科学完整性与生物安全筛查无账户配额限制严格前置质检,偏向伦理与数据合规
SSRN披露备案与机构声誉绑定无账户配额限制强制要求工具使用声明,人类作者负全责
OpenReview承办学术会议自主裁定依各会议规则而定要求人类作者身份,系统内设 AI 披露模块

arXiv 这种按人头卡配额的做法,最先伤到的往往是守规矩的人。

当下一个大型人工智能实验室通常由数十名研究人员协作,在顶会截稿日前夕,一个正规课题组一个月内产出3到5篇跨方向成果是常态。单月限投2篇的硬杠杠,直接打乱了科研团队抢注创新优先权的节奏。更让社区焦虑的是,针对已发布论文的正常修正版本是否会占用当月2篇额度,官方在细则中依然语焉不详。

  • 风险.配额管制只限制了单个账户的吞吐量,黑产团伙完全能通过注册大量虚假马甲、利用挂名掮客轮流投递等方式绕开拦截;唯独无力组织复杂账户矩阵的普通科研人员,将不得不独自消化排队延误与配额受限的制度成本。

当高校与研究机构的绩效体系仍然以论文篇数论英雄,AI 充当的只是灌水放大器。arXiv 拧紧预印本龙头固然能给喘不过气的审稿人争取短暂的缓冲,但只要下游的考核逻辑不变,这道物理节流阀就难以从源头阻断学术泡沫的蔓延。