DeepSeek V4 Pro 0813 已经出现在 OpenRouter,目前只能通过 API 调用。反常之处在于,DeepSeek 没有同步给出醒目的官方公告,外界也尚未确认模型是否会开放权重。

这更像一次“先提供端点、后补发布材料”的上架,而非信息完整的模型发布。对想尝鲜的开发者,它已经是一个能调用的产品;对准备接入生产系统的团队,它仍是一个身份、能力边界和后续维护承诺都没有充分说明的新端点。

DeepSeek V4 Pro 0813 已能调用,官方信息却没有跟上

目前能够确认的事实不多:OpenRouter 已列出 DeepSeek V4 Pro 0813,原始报道也实际调用了这个模型。但在 DeepSeek 自有渠道中,没有找到与之对应的清晰公告页面。

这一区别很重要。OpenRouter 是模型聚合与路由平台,条目上架说明 API 可用,却不能替代开发者通常需要的官方材料,例如版本变化、训练与对齐方法、上下文限制、价格依据、已知缺陷,以及端点背后的模型是否会保持不变。

公开线索可以归纳为:

线索目前能确认什么仍缺什么
OpenRouter 的 V4 Pro 0813 条目模型已可通过 API 调用官方发布说明、版本变更记录
4 月的 DeepSeek V4 Pro 权重页此前同系列型号曾出现在 Hugging Face0813 版本是否沿用相同开放策略
7 月的 DeepSeek V4 Flash 0731 权重页DeepSeek 过去有发布权重的先例新版权重的时间表与许可证
社区流传的跑分表有一组结果正在被讨论原始测试配置、评测脚本和官方出处

4 月的 deepseek-ai/DeepSeek-V4-Pro 与 7 月的 deepseek-ai/DeepSeek-V4-Flash-0731 都已有 Hugging Face 页面,因此 0813 版本未来开放权重并非没有可能。但“过去开放过”不能直接推出“这次也会开放”。许可证、部署要求和发布时间仍要等 DeepSeek明确说明。

这件事真正暴露的,是模型分发已经快过发布流程。API 平台可以让一个版本迅速进入开发者工具链,但官方信息若没有同步到位,用户很难判断自己调用的是正式版本、灰度版本,还是会被静默替换的服务端快照。古人说“名不正,则言不顺”,放到 API 市场里,就是模型标识不清,后面的跑分、采购和复现都会失去共同基准。

跑分传播链太长,三只鹈鹕也证明不了能力高低

现有跑分材料的可信度有限。按原始报道追溯,这组数据据称先出现在 DeepSeek 微信群,随后被转贴到 Reddit;相关帖子又因“低质量内容”被版主删除,最后只剩 Hacker News 评论区中的 ASCII 表格。

这条传播链缺少最关键的一环:可核验的一手来源。没有官方评测页、测试参数和原始记录,读者无法确认模型版本、推理预算、采样设置及计分方法。数字即使抄写无误,也不适合直接拿来与其他模型排位。

原始报道还做了一个更直观的测试:让模型在低、中、高三档推理强度下绘制“骑自行车的鹈鹕”。三档输出的构图和画风差异很大,分别出现了不同的自行车颜色、背景元素和配饰。

这个现象有观察价值,但不能被解释成“高推理档一定更强”。生成结果变化可能来自推理预算,也可能受到采样随机性、提示词处理方式或服务端配置影响。要判断档位差异,至少需要固定提示词与参数,多次重复生成,并记录每次延迟、费用和输出。三张图片只能提出问题,不能完成评测。

相比 OpenAI、Anthropic 等公司通常配套发布模型说明、价格与系统卡的做法,DeepSeek V4 Pro 0813 当前缺少的不是传播声量,而是让外部复现和采购决策成立的证据。模型能力或许很强,但现阶段的公开材料不足以支持这个结论。

开发者可以低风险试跑,生产团队应延后迁移

个人开发者和研究者可以把它当作候选模型测试,但应保留完整记录:使用确切的模型标识,固定提示词和推理档位,记录调用日期、响应时间、Token 用量、费用及原始输出。这样即使端点行为发生变化,也能判断差异来自代码、模型还是平台路由。

已经在线上使用其他模型的团队,暂时没有足够理由迁移核心业务。现实风险不只在效果,还包括版本能否固定、价格是否稳定、限流规则是否明确,以及故障时由谁提供支持。一次跑分领先,抵不过生产系统里一次无法解释的输出漂移。

接下来应盯住三个可验证动作:DeepSeek 是否发布正式模型卡,OpenRouter 条目是否补齐价格、上下文和提供方信息,以及 0813 权重是否进入 DeepSeek 的 Hugging Face 账号。前两项决定 API 能否认真评估,后一项决定本地部署和独立复现是否可行。

在这些信息出现前,更合适的决策很清楚:可以拨一小部分测试预算,不要接管关键流量;可以加入内部模型对照,不要据此替换现有供应商。