X在周四放出了一份规模是此前10到15倍的开源代码包,把"For You"信息流的核心排序引擎连同过滤器、模型配置一起搬上了GitHub的xai-org/x-algorithm仓库,用的是宽松的Apache v2协议。配套上线的"Under the Hood"页面,让过去一个月发过十条以上帖子的用户下载一份JSON文件,看自己的账号有没有被打标签——这是马斯克旗下平台第一次拿出具体工具,正面回应持续多年的"shadowban"指控。但把代码清单看完就会发现,能自证清白的工具,离真正把算法关进玻璃房子还差一截。

这次开源的力度放在行业里确实罕见,拿去和Bluesky、Meta的Threads比都占优势。可同一时间,欧盟正就同一套推荐系统立案调查,此前的独立审计还认定X的风险缓解措施"无效"。放在这个背景下看,这次开源更像一次精心计算过边界的公关动作,而不是把黑箱彻底打开。

打分公式露出来了,但只露了一半

X这次公开的不只是代码框架。仓库里能看到完整的排序公式:final_score等于把用户对一条帖子做出点赞、回复、转发、引用、点击、关注等正向动作的预测概率乘以对应权重后加总;拉黑、屏蔽、举报、标记"不感兴趣"这些负向信号同样带权重,只是方向相反。围绕这个公式,还有DropDuplicatesFilter(去重)、AgeFilter(时效)、MutedKeywordFilter(屏蔽词)、AuthorSocialgraphFilter(社交关系)在内的十一类具名过滤器,负责把不该出现的内容提前拦下。

产品副总裁Keith Coleman说这份代码"人们看了会震惊",这话不算夸张——普通用户第一次能确认,压低可见度的机制真实存在于代码里,不是传闻。

开源力度与准入门槛 15倍 代码库规模增幅 10条 月发帖数门槛 1年 测试组账号年龄

透明度工具先只对满一年的账号做小范围测试,普通用户要等它扩大范围才用得上;哪怕用上了,JSON文件给出的也只是标签和聚合数据,想搞懂"为什么",还得自己把文件丢进大模型去问。

被留在暗处的那一块

这次开源明确排除了一类系统——用Grok判断一条帖子是否违规的模型。X给出的理由是防止恶意用户拿着规则细节反向优化,批量绕过审核刷垃圾内容。

这个理由站得住脚,却也刚好挡住了外界最想看的部分。多年来关于"shadowban"的争议,焦点从来不是过滤器叫什么名字,而是有没有一套针对特定立场或人物的隐藏判断逻辑——Grok审核系统恰恰是最可能承载这种判断的地方。代码开源证明了"降权机制存在",但证明不了、也排除不了"降权机制被选择性使用",这是两件不同的事。

研究者泼的冷水:能看架构,不能复现现场

外部研究者拿到代码后确认了一件积极的事:排序打分模型能在X之外单独跑起来,这在Coleman看来是本次发布的里程碑。但更多研究者的判断没那么乐观——他们把这次发布形容为"部分保留或不完整",训练数据来源、生产环境里正在跑的完整模型权重、实时配置,一样都没给。

能看代码结构,不等于能复现用户此刻刷到的信息流
代码公开了什么,仍看不见什么 代码公开 排序打分公式 十一类具名过滤器 打分模型可独立运行 模型配置参数权重 仍不可见 训练数据来源 生产环境完整权重 实时线上配置 Grok违规预测逻辑

一个用户如果真的怀疑自己被降权,拿着GitHub上的代码和自己的JSON文件,大概率只能确认"存在某个过滤器命中了我",却查不出这个判断在生产环境里是不是被同样的逻辑触发——因为线上那套配置,用户永远看不到。

  • 风险.公开的代码库最近一次更新在5月,和此刻线上跑的版本是否同步,X没有承诺。

监管账本:欧盟不是来看热闹的

X把这次开源包装成对"透明度关切"的回应,但同一时间轴上还有另一条线索。

与监管交错的时间线 2018 shadowban指控 2026-01 欧盟立案调查 2026-05 仓库大更新 2026-08 本次开源公告

2026年1月,欧盟委员会就Grok和X的推荐系统正式立案调查,审查的正是非法内容、性别暴力以及Grok部署带来的风险有没有被充分评估和缓解。更早之前,针对X的独立DSA审计给出的结论是:X现有的系统性风险缓解措施"无效",缺乏有效性衡量标准。

《数字服务法》第27条要求平台用通俗语言解释影响推荐的主要参数和相对权重,第38条要求提供至少一种不依赖用户画像的推荐选项——两条都没有要求公开源代码。换句话说,X这次做的比监管要求的多,但监管真正在意的问题——风险缓解是否有效——这次开源没有正面回答。


横向坐标:谁的透明度更彻底

拿行业里另外两个参照系摆一摆会更清楚。Bluesky走的是"算法市场"路线,任何人都能通过AT Protocol自己写一套排序算法并发布,架构层面完全开放;Meta的Threads只做产品层面的解释和开关,官方从没放出过生产环境算法的代码仓库。X这次的姿态介于两者之间偏开放的一侧——给代码,但保留部署权和最终解释权,用户能看,不能改,也验证不了线上到底跑没跑这套代码。

  • 结论.普通用户能确认"降权机制真实存在",但确认不了"是否轮到自己被针对"。

接下来值得盯的是三件具体的事:测试组什么时候扩大到普通账号;有没有第三方真正拿公开代码跑出和生产环境一致的排序结果;欧盟那份调查最后认不认这次披露算数。这三件事有答案之前,"能不能自证没被shadowban"这个问题,眼下的答案只有一半。