2005年9月10日,英国网络管理员Gary Rolland在NetBSD官方邮件列表netbsd-advocacy上发了一封长邮件,讲自己怎么把公司29台高负载服务器从Windows换成NetBSD 2.0.2。这些服务器撑着超过4800名重度用户,每天推送870GB以上数据、约1200封邮件,跑MySQL、Apache、Postfix、Samba。他说换系统之前,Windows服务器隔三差五宕机,他半夜被叫回机房,甚至有一次为此取消了带女儿去游乐园的承诺。这封邮件后来被NetBSD官方收进了testimonial(用户证言)页面。

这不是产品评测,是一份没有对照组的个人陈情。它值得被记住,恰恰是因为它太典型——典型到能拿来拆解一整套“开源更稳”的叙事是怎么被搭起来的。

29台服务器,一次“先干了再汇报”的赌注

Rolland的做法有点野:老板还不知道NetBSD是什么,他先把两台服务器(一台MySQL、一台httpd)偷偷带回家配置好,第二天直接塞进生产环境。赌的是Windows服务器会先出问题——结果真出了问题,MySQL机器又宕机重启,老板两小时内就批准了扩大部署。

这个细节比“换系统更稳定”本身更有信息量:它说明整个决策链条不是技术评估出来的,是运气加胆量赌出来的。团队后来花时间学pkgsrc、编译内核、打印NetBSD手册,管理员的技能也在同步升级。稳定性的提升,到底是操作系统换了,还是人换了做事方式,邮件里根本分不清。

Rolland的迁移规模(2005) 29 台服务器 NetBSD 2.0.2 4800+ 重度用户数 870GB/天 日均数据吞吐 1200封/天 邮件处理量

同一年,微软也在打一场稳定性的公关战

Rolland发这封邮件的时候,微软没闲着。2005年4月,微软资助的VeriTest测试结果宣称Windows Server 2003比Red Hat Enterprise Linux AS 3.0更可靠;同年11月又有一份对比Windows与SUSE Linux的报告,结论同样偏向Windows。Ars Technica当时的评价很直接:这份报告读起来像微软的公关材料。

一边是社区论坛里一封带着私人感情的邮件,一边是厂商掏钱做的基准测试——两边都不是严谨的对照实验,却都在试图证明同一件事:我的系统比你的更稳。2005年恰好是这场论战最热闹的一年,也是NetBSD从2.0过渡到2.1(同年11月发布)的节点,BSD在企业市场仍然是边缘选择,主流位置牢牢被Windows Server 2003占着。

稳定性从来不是内核的属性,是叙事双方都想抢的话语权

有意思的反证是,同期WindowsBBS论坛上有用户报告,一台Windows Server 2003 Enterprise数据库服务器大约每20天就要宕机5到10小时——这个故障频率,和Rolland描述的Windows噩梦其实差不太远。说明问题未必出在系统内核,更可能出在配置、负载和维护习惯上。

被邮件忽略的变量:旧硬件和异构环境

Rolland的邮件里藏着一个不对等的对比:他吐槽的Windows服务器跑在“较老的硬件”上,而NetBSD是全新部署,硬件代次直接就不同。老硬件+老系统本来就容易先倒下,这笔账算不清楚,功劳就没法全记在NetBSD头上。

  • 风险.邮件里公司文件服务器仍在跑Linux,NetBSD只接管了Web、邮件和数据库前端——这本身就是异构环境,不是“全面NetBSD化”的证据。

企业选型这件事,2005年的现实是:即便NetBSD个案表现亮眼,Windows仍靠Active Directory集成、商业软件认证、供应商支持在组织层面占优。Rolland团队最后能做到周末远程SSH运维、不用被叫回机房,靠的其实是管理员集体啃透了一套新工具链,这份纪律换到任何系统上,大概率都会带来类似的稳定性提升。

  • 结论.真正决定运维体验的,往往是硬件代次、管理员技能和维护纪律,操作系统内核只是其中一个变量,不是全部答案。

这封邮件二十年后读来,最该被记住的不是“NetBSD赢了”,而是它提醒我们:任何一个孤例式的稳定性证言,不管来自热心用户还是厂商基准测试,都经不起放进对照实验里细看。