OpenAI在最新一期数据更新里第一次把ChatGPT的使用情况按国家拆开公布:工作场景里,用户用它完成任务、写代码、做分析的比例,是闲聊场景的两倍多;秘鲁、乌拉圭、哥斯达黎加这些国家的人均使用排名,一个季度内窜到了前列;巴西、哥伦比亚的多媒体类消息占比超过一成;法国和捷克,35岁以上用户的消息占比一年涨了10个百分点以上。
四组数字听起来都在讲同一个故事:ChatGPT正在从年轻人的玩具,变成全球所有年龄段、所有地区都在用的工具。故事本身没问题,问题是,这套数据到底有多结实。
每月30万条消息,怎么撑出127国排名
OpenAI公开的方法论文档写得很克制:这份数据集来自每月约30万条消费者端消息抽样,覆盖2024年7月到2026年6月,只统计18岁以上用户,企业账户、Codex和不同意训练数据使用的用户都被排除在外。人均排名用的是2023年世界银行人口数据做标准化。
30万条听起来不少,但分摊到100多个国家、再叠加年龄、场景、多媒体类型这些维度切分之后,单个“国家—季度”格子里能落下的有效样本,可能薄得可怜。OpenAI自己也用了防护措施:差分隐私加噪处理,并且只有一个格子加权去噪后的消息数超过100条,才会被公开——够不着这条线的国家和维度,直接从数据集里消失。
也就是说,秘鲁、乌拉圭这类人口本就不大的国家,排名跃升几个位次,很可能只是因为分母小,几百条消息的波动就能把名次拉高好几名。OpenAI公布的是相对排名,不是原始人均消息数——外界没法验证这个跃升到底是真实趋势,还是加噪之后的统计巧合。
- 风险.小国排名对样本波动极度敏感,加噪+阈值过滤又让人没法反推真实规模,政策研究者引用时容易把噪声当信号。
时点凑得太巧:数据发布撞上产品上线
工作场景“做”的比例翻倍,这个结论发布的时间点,恰好紧跟在企业向产品ChatGPT Work推出之后;多媒体消息占比上升到7.8%,巴西哥伦比亚破一成,对应的是ChatGPT Images 2.0在2026年4月的上线。两条曲线的转折点,都精确对上了新产品的发布节奏。
这不代表数据是编的——产品能力变了,使用习惯跟着变,是符合常识的因果链。但一份同时承担“中立研究”和“新品效果背书”两个角色的数据,发布节奏卡得这么准,读者至少该多问一句:如果Work上线后工作场景占比没涨,这份数据还会不会被这样发出来。
35岁以上用户占比上升的数据也有类似的松动地带。这组结论只统计了自愿在平台上填写年龄的用户子集,不是全体用户的真实年龄分布。愿意填年龄的人,本身可能就是教育背景、职业类型更偏某一类的群体——这层偏差,原文没有提。
谁该在意,接下来该盯什么
对政策制定者和研究机构来说,这套数据可以用,但引用具体国家排名之前,最好先确认样本是否够得着100条阈值——OpenAI没有公开每个国家的原始样本量,这一步现在只能靠猜。对企业客户来说,“工作场景使用翻倍”这类数字,更适合当作产品能力提升的信号,而不是拿去直接测算自己团队的效率增益。
中国、印度这两个人口大国,没有出现在本次127国和126国的公开名单里——原因未知,可能是数据未达标,也可能是统计口径限制。这一空白,恰恰是判断这套数据代表性最关键的一块拼图,目前还看不清。
排名会说话,但样本量太小时,它说的常是噪声自己的话。
接下来真正值得盯的,不是这一季的排名涨跌,而是Q3数据能否延续同样的趋势,以及OpenAI是否会公开原始人均消息数——那才是检验这些排名是否站得住的唯一办法。
