TechCrunch 公布了 Disrupt 2026 主舞台的最终嘉宾阵容。表面上看,这是一场标准的行业盛会——大会定于 10 月 13 日至 15 日在旧金山 Moscone West 举行,聚拢了 Rivian、Science Corp、Bluesky、Replit 以及全员合体亮相的 Benchmark 投资团队。但只要穿透官方议程里那些宏大叙事就会发现,排在聚光灯核心的两个议题,恰恰对应着硅谷眼下最难堪的两道坎:AI 算力正在撞上现实电网的物理天花板,而现实世界中的算法监控则正在撞上公民自由与法律治理的红线。

这不再是一场比拼谁的模型参数更大、融资估值更高的画饼集会,而是一场技术理想被迫向现实规则低头的防御战。

晶圆吞电与分离推理:Cerebras 挑起对英伟达的逆袭

Cerebras 创始人 Andrew Feldman 登台要回答的核心命题,是支撑过去三年繁荣的 Scaling 法则是否正在破裂。与两年前纯粹讨论参数量不同,如今的死穴变成了电力与推理延迟。

Cerebras 推理性能暴增与空载能耗代价 极速推理表现 (Llama 3.3 70B) Cerebras: 2,457 tokens/s 云端 GPU: 164 tokens/s CS-4 系统宣称推理最高达 GPU 的 30 倍 晶圆间通信延迟大幅压缩至 2 微秒 物理与经济瓶颈 +10% ~ 60% 独立测试:待机功耗显著高于主流 GPU · 签约锁定电力:600 MW 数据中心容量 · OpenAI 合作协议:数年交付 750 MW · GPT-OSS-120B 输出定价:$0.75 / 百万 token

Cerebras 在 2026 年 8 月推出了 CS-4 芯片系统。这套系统由 3 颗 WSE-3 Turbo 处理器拼装而成,把晶圆之间的通信延迟压到了 2微秒。官方宣称其推理速度最高可达常规 GPU 系统的 30倍,每瓦吞吐量较前代 CS-3 提升最高 10 倍,甚至扬言能让十万亿参数的大模型跑出超过 1,000 tokens/s 的推理速度。而在 2026 年 4 月 14 日的基准测试中,Cerebras 在 Llama 3.3 70B 上的确交出了每秒 2,457 个 token 的速度,将对照组云端 GPU 的 164 tokens/s 甩在身后;跑 GPT-OSS-120B 时,其实测速度也达到 1,735 tokens/s,远超云端 GPU 的 295 tokens/s。

但极致速度的背后藏着沉重的代价。独立加速器能耗研究戳破了部分光环:Cerebras、SambaNova 与 Gaudi 这类架构的空闲待机功耗,比同等算力的英伟达和 AMD GPU 高出10%至60%。这意味着它的能效优势完全取决于机架是否处于每分每秒都满载的高饱和状态,一旦调用量出现波谷,电费账单就会变成噩梦。

速度的上限由晶圆面积决定,但生意的底线被变电站牢牢钉死。

即便其平台在 2026 年 10 月 5 日对 GPT-OSS-120B 给出了输入每百万 token 0.35 美元、输出每百万 token 0.75 美元的 API 低价,这类定价更接近抢占生态位的补贴策略,而非基础设施的真实综合持有成本。为了把这套晶圆级打法跑通,Cerebras 必须抢先锁定基础设施底牌——目前它已签署协议锁定 600 MW 数据中心电力,计划在 2026 年内将芯片产能拉升 10 倍以上,并与 OpenAI 签署了数年内交付 750 MW 高速推理容量的合作协议。

与单一芯片狂飙并行的,是架构层面的拆解与合围。Cerebras 与 AMD 联合开发了分离式推理系统,把 prefill 与 decode 阶段解耦,将整机吞吐量提升最高 5 倍,定于 2026 年第四季度投产。无独有偶,AWS 也计划在 2027 年第一季度将类似的分离式推理架构引入 Bedrock 平台。配合主舞台上 Ricursive Intelligence 两位创始人展示的 AI 自主逆向设计芯片能力,芯片产业不再单赌英伟达的机架垄断,而是试图用分离架构与专用晶圆撕开缺口。

  • 风险.如果初创企业缺乏持续跑满的高并发任务,强行切入超高速晶圆级推理架构,高企的空载功耗将在实际电费中抵消纸面性能收益。

12万台探头陷入信任危机:Flock Safety 的防守反击

主舞台的另一侧,Flock Safety CEO Garrett Langley 将要进行的关于 AI 与公共安全的对话,则是一场彻底的危机公关。在 TechCrunch 的议程表里,Flock Safety 代表着安防现代化的标杆,但真实世界里的反噬正在全面爆发。

Flock Safety: 12万台监控探头引发的合规与抵制链条 2026年1月 加州山景城调查曝光 数百机构无许可查数据 2026年8月 《华盛顿邮报》曝私用追踪 参议员 Hawley 启动调查 2026年9月 媒体曝光监控抗议集会 数据留存期被迫压至7天 2026年10月1日 科罗拉多埃尔帕索县退网 地方政府终止合作

Flock Safety 在全美铺设了超过 120,000台 车牌识别摄像头,织就了一张覆盖极广的视觉监控网。然而,技术在现实中不可避免地滑向滥用。2026 年 1 月,加州山景城的公共记录调查显示,数百家机构未经当地许可调阅其辖区内的 Flock 监控数据长达 17 个月,迫使该市最终停用了全部监控摄像头。

到了 2026 年 8 月,《华盛顿邮报》披露多起警察利用这套跨区域系统跟踪前任的私用案件。同年 9 月,《404 Media》进一步曝光 Flock 曾开展专项培训,教警方利用整合了摄像头、无人机和警务数据库的平台监控抗议集会。

地方抵制随之蔓延。就在大会开幕前夕的 2026 年 10 月 1 日,科罗拉多州埃尔帕索县正式宣布终止使用 Flock 的系统。而在联邦层面,参议员 Josh Hawley 在 8 月针对数据访问权限与滥用指控正式发起国会调查。为了遏制信任崩塌,Langley 被迫宣布紧急整改,将常规数据留存期从 30 天大幅缩短至 7天,并引入强制第三方审计。但把留存期砍到 7 天能否抵御针对宪法权利侵犯的质疑,依然充满未知数。


狂欢退潮后,资本重排算力与落地的硬账本

主舞台上其他环节的设置,进一步印证了硅谷叙事重心的漂移。当 Benchmark 的五位合伙人少见地全员同台,他们面对的创投环境早已不是 2024 年那种只要有大模型原型就能拿到支票的时代。从亚马逊高管 Panos Panay 探讨手机之后的硬件形态,到 Bluesky 审视去中心化社交网络能否重来,整个行业都在为高昂的算力基建寻找真实回报。

机构 / 企业核心方案与动作落地时间 / 规模关键瓶颈与考验
Cerebras推出 CS-4 晶圆级系统与分离式推理600 MW 签约电力;750 MW OpenAI 协议空载功耗偏高 10%~60%,极度依赖满载运行
AMD & Cerebras联合开发 prefill 与 decode 分离推理方案预计 2026 年 Q4 投产软硬件栈适配深度与异构集群维护复杂度
Flock Safety缩短数据留存至 7 天,引入强制审计覆盖全美 120,000 台车牌识别探头跨机构私用滥用、地方退网及国会问询发酵

这三组代表性力量清晰地切开了当下的科技断面。技术团队宣称的数倍吞吐与十微秒级延迟,最终必须算清每千瓦时的运营总成本;而算法对物理世界的感知与介入,也绝不可能游离于宪法自由与地方监管的审计之外。

  • 结论.买单方的决策重心已从比拼纸面跑分,彻底转向考量数据中心的电网配额与监管合规的抗风险能力。

Disrupt 2026 主舞台即将上演的言辞交锋,其价值不在于几家明星公司描摹的技术蓝图,而在于这群曾经只信奉指数级增长的硅谷精英,如今必须当着全行业的面,交代他们打算如何应对电网超负荷运转的现实,以及如何平息技术越界引发的制度反弹。