健康经济学家Jason Semprini写了一篇关于HPV疫苗强制接种政策的论文,发现一个反直觉结果:强制打疫苗,并没能明显降低人群整体的宫颈癌发病率。这个结论没问题,他也很兴奋。但论文被拒了——唯一的审稿人把"评估一项政策的效果"看成了"质疑疫苗本身有没有用",两码事被读成了一码事。
按流程,一篇论文通常要过两三个审稿人的眼,一个人理解错了,另外两个能兜住。这次只有一个人审,兜不住,直接拒稿。
30封邀请信,换回1个"愿意"
这不是个别倒霉事。期刊编辑Steven Mack说,五年前想凑齐三名审稿人,发5到10封邀请邮件就够了。现在,他要发大约30封,才能找到一个人肯接这活。
背后是论文数量的持续膨胀,叠加AI辅助写作降低了写论文的门槛——投稿量涌上来了,但愿意无偿花时间审稿的人没跟着涌上来。
结果就是:编辑开始把审稿任务塞给不够专业、也没空细看的人。计算机科学家Haewon Jeong的说法很直接——现在常收到"根本不懂这个领域"的审稿意见。
15亿美元这笔账,口径先要问清楚
关于评审系统有多累,一个流传很广的数字是:全球研究者每年为同行评审投入约1.5万"研究者年"的时间,按美国审稿人的薪酬折算,价值约15亿美元。
但这里有个容易被忽略的细节。这15亿美元,是拿"美国的薪酬标准"去套算"全球总工作量"得出的价值,而不是"美国审稿人实际做的那部分"。如果换成按各国本地薪酬折算,同样的工作量价值只有大约4亿美元——差了近四倍。一个数字,两种算法,讲的其实不完全是同一件事。
论文数量年增5.6%这个常被并列引用的数字,也另有来处——它出自一篇独立的文献计量学研究,跟评审成本的测算不是同一份材料。两条数据被摆在一起讲,容易让人以为是"一份研究说明了一切",其实是两笔账。
这套"信任品牌",满打满算才50年
同行评审给人的感觉,像是科学天生就有的规矩。其实不是。
历史学者Aileen Fyfe说,19世纪的学会评审很松散,更像一群业余绅士学者每周聚会聊聊天、顺手编本杂志。它变成学术出版的"普遍标配",满打满算只有大约50年,而这50年的起点,跟科学本身关系不大——跟一场公关危机有关。
1970年代美国经济不景气,通胀、失业、油价都出问题,国会开始质疑NSF(美国国家科学基金会)的拨款是不是花得明白。NSF早在1950年代就用外部评审人审批经费申请,这套机制救了它——因为决策是独立评审组做的,"合法性"这个东西自然就带上了,国会也不好直接插手拨款方向。
历史学者Melinda Baldwin说得直白:这本质上是"科学家向其他利益相关方做的一场销售"。同行评审能立住,不是因为它天然是真理的守门人,而是因为它当年成功证明了自己值得信任。
兴也因信任,困也因信任。
今天这套系统还在靠同一种信任撑着,只是当年撑起品牌的无偿劳动,已经供不上眼下的论文洪流。
修补,还是拆开重装
面对审稿人枯竭,业内讨论的不是"要不要救",而是"怎么拆开分别救"。同行评审这一件事,其实捆绑了至少五种功能:筛选、传播、批评、可重复性验证、职业晋升信号。
正在被讨论的几条路,各有各的代价:
- 预印本优先+发表后评审.先发出来,让全社群评,速度快,但缺一个统一的质量门槛。
- 公开评审(署名或公开审稿报告):提高问责,但年轻审稿人面对权威作者,反而更不敢说真话。
- 付费审稿.能缓解人手荒,但也可能把一份专业责任变成一件走过场的活儿。
- 可携带评审、注册报告、AI辅助初筛:分别解决"评审浪费在重复劳动"和"筛选耗时"的问题,还在早期试验阶段。
- 风险.付费不必然换来质量,反而可能让评审从"专业担保"滑向"交易任务"。
AI领域已经先走了一步。因为这行发展太快、很多研究者根本不靠期刊评职称,一部分人直接转向博客发布,用社群点赞和评论代替传统评审。AI Alignment Forum是个典型例子——文章靠社区投票和评论浮出水面,速度远快于等一篇论文走完评审流程。
但这条路不是没有代价。哲学家David Thorstad坚持只发同行评审过的成果,他因此没法引用一大批发在博客上的重要工作——"这限制太大了"。社群投票也一样,谁的声音大、谁写得顺口,不完全等于谁的研究站得住。
同行评审的问题,从来不是"AI来了突然崩了",而是这套靠无偿劳动撑了50年的信任机制,本来就没解决过供需账。现在只是账,终于摆到台面上了。
