Hugging Face上最近冒出一个仓库,名字叫Qwen/Qwen3.8-2.4T-A95B。光看名字信息量很大:2.4万亿总参数、950亿激活参数,一看就是要对标DeepSeek、Kimi、GLM那批超大规模MoE模型的架势。但翻开这个仓库,能读到的"正文"只是tokenizer_config.json里一段标准的chat template代码——处理工具调用格式、<think>推理标签怎么渲染,跟模型本身的能力毫无关系。没有模型卡叙述,没有阿里官方公告,没有GitHub页面能对上号。

核实到这一步,判断已经清楚:这看起来不像一次正式发布,更像一个还没讲清楚自己是谁的仓库。

权重是真的,身份是假的

有意思的是,这个仓库并非空壳。页面的技术元数据显示,权重文件是真实上传的——总参数约2.44万亿(BF16精度),分片存储,总文件体积接近4.89TB。这个体量和标题里的"2.4T"能对上,不是空手套白狼式的抢注。

但截至目前,该仓库下载量978次、点赞419个,创建于8月初,更新于8月中旬。对照一下:阿里每次真正发布Qwen新一代模型,官方渠道(通义千问公众号、GitHub、Hugging Face官方组织账号)几乎同步跟进,社区讨论量通常是数量级的差距。这点热度,更像圈内小范围围观,而不是一次被官方力推的重磅发布。

能核实到的四个数字 2.44万亿 BF16权重总参数,真实分片上传 4.89TB 权重文件总体积 978 累计下载次数,热度不算高 未经验证 跑分表状态,全部标注verified:false

一张跑分表,却写着"未经验证"

仓库页面确实挂了一份基准测试表,涵盖SWE-bench Pro、GPQA-Diamond、HLE等几项主流评测,数字看起来不差。但每一条记录都标注了verified:false,来源是第6号pull request——也就是社区提交,不是Qwen团队官方跑分。

这和阿里过去几代Qwen模型的发布节奏不一样。Qwen2、Qwen2.5、Qwen3每次上新,都是模型卡、技术报告、官方跑分三件套齐全,社区复现和第三方评测紧跟着来。这次连"第一方数据"都缺,只有一份靠外部提交、尚未确认的表格。

  • 风险.如果开发者只看到跑分数字就直接引用或下载调用,等于把决策建立在未经核实的信息上。

架构标签写的是"3.5",仓库名却是"3.8"

再往细节里看,还有一个不太起眼但值得留意的错位:这个仓库的模型架构标签是qwen3_5_moe_text,对应的是"Qwen3.5"系列的MoE架构类别,但仓库名字却叫"Qwen3.8"。License字段标的是"other",不是Qwen官方常用的通义千问许可证标注。

这三件事拼在一起——架构标签对不上代际名号、许可证类型不常规、没有模型卡叙述——比单纯"名字看起来很假"更有说服力。它指向几种可能:内部测试文件被误传、有人fork后改了仓库名、或者是占位性质的过渡仓库,而不是一次正式产品线的对外发布。目前没有证据能排除其中任何一种,也没有证据能确认其中任何一种。


对普通开发者来说,真正的坑不在于"这个模型强不强",而在于会不会因为标题里的"2.4T"三个字,就把它当成阿里的官方路线图去参考。对关注MoE竞争格局的从业者和分析师来说,更实际的做法是把这类仓库归入"待确认"清单,盯紧阿里官方Hugging Face组织账号、GitHub仓库和通义千问公众号是否补发说明——而不是拿一张标注着"未验证"的跑分表,去跟DeepSeek、Kimi、GLM做真正的横向对比。