人工智能资讯
聚合当前分类下的最新内容,按时间顺序查看第 1 页精选文章。

Google说太阳已经落山,沉下去的是整个网络的记忆
Google AI摘要编错日落时间只是个引子,真正的问题是原始网页正变得难以被点开、被保存。FiveThirtyEight存档被整站删除、Wikipedia回流点击减少、Internet Archive遭诉讼与封锁,三条线各有各的直接原因,但共同指向同一个松动:检索和存档正被交给一家广告公司,却没人对公共记录的存续负责。

671B参数写在论文里,DeepSeek却说自己是在猜
有人逐条追问DeepSeek的架构细节,把回答分成观察、推理、猜测三档,结果发现模型对早已公开的671B参数、256个专家这类著名数字反而含糊其辞。这套访谈听起来诚实,但学界早有共识:模型说得像懂自己,和真的懂自己,是两件不同强度的证据。

Redis之父做视频AI引擎:3.5秒的基准,目前只有他一人验证
Redis创造者antirez发布h3.c,让MiniMax-H3视频生成模型原生跑在Mac的Metal上,宣称M5 Max上4步降噪仅需3.5秒。但这个数字、M5 Max芯片本身的发布状态、以及上游MiniMax-H3的官方许可信息,目前都只有开发者自己的说法,没有第三方交叉验证。

亚马逊为AI供电,得州电厂或成全美排放冠军
亚马逊确认投资得克萨斯州Pecos County一座离网天然气电厂,专供其AI数据中心,现有许可方案下年排放上限达3300万吨二氧化碳,可能超过美国任何一座现役电厂。这不是孤例,而是xAI之后AI巨头集体转向绕开电网审批的新范式,而一场围绕清洁空气法执法权的官司,正悄悄决定这套模式今后还能不能被社区挡下。

Meta称靠开放模型重启AI战略,官方发布记录却接不上茬
外媒称Meta将发布开源模型Muse Glimmer并开放Muse Spark 1.2权重以重启AI战略,但截至发稿,Meta官方渠道最新可查的开放动作仍是7月API化的Muse Spark 1.1,8月发布并无对应记录。真正值得关注的不是新模型本身,是这套“重启叙事”和可验证事实之间的落差。

扎克伯格想用AI治愈孤独,可社交媒体的账还没还清
The Verge一篇题为《扎克伯格不懂如何生活》的评论文章,矛头指向他一年前发布的'个人超级智能'宣言——核心争议不是他私生活,而是Meta想用AI填补人类的陪伴与关系需求,而这家公司过去二十年恰恰因加剧孤独和青少年心理问题屡遭质疑。

Claude给AI内容打标记,但『有标记』不等于『能查证』
Anthropic在支持中心新增《How Claude marks AI-generated content》文档,但公开部分只有导航链接,没写清楚具体机制、覆盖哪些Claude产品、什么时候上线。可见标记、元数据、数字水印、检测器是四回事,媒体、教育机构和合规团队不能把『有标记』当成『能验证』的证据。

扎克伯格的6500字AI宣言:只讲收益,不讲代价
扎克伯格发布6500字《个人超级智能》宣言,用教育、法律、免费算力三个场景描绘AI普惠前景,这套说法两周前《华尔街日报》已披露过,这次只是最完整的公开版本。真正的问题不是他看好AI,而是他对教育、法律场景里已经出现的滥用和摩擦只字不提,把商业产品直接包装成社会进步。

14MB模型说自己不输大厂,基准表却写着大半场落后
Cactus Compute发布45M参数、14MB单文件的开源工具调用模型Needle 2,官方称与FunctionGemma、LFM2.5、Apple FM互有胜负。但拆开官方自己发布的完整基准表,Needle 2在两个综合测试上其实全面落后,真正的优势集中在工具名识别和陌生场景泛化两个窄指标上,而最吸睛的硬件速度承诺至今无人独立复现。

从1.5%到95%:OpenAI给'白帽子'松绑的AI,战斗力到底几何
OpenAI把网络安全模型的拒答率从1.5%拉到95%,包装成防御窗口收窄前的关键武器,但同一份系统卡显示它在真实高难度目标上的战绩依然惨淡,谁能拿到这把更松的钥匙也完全没公开。

扎克伯格炮轰'封闭AI',Meta喊'开放'的这次牌面里到底有多少实货?
扎克伯格公开批评OpenAI、Anthropic等对手走'封闭'AI路线,宣布Meta重新拥抱开放模型,但这条消息本身几乎没有可验证的细节——无新模型、无许可证条款、无时间表。开放的旗号喊得响,实货还得等产品说话。

Claude把黎曼猜想相关下界从41.6%提到67.2%,但猜想本身还是没解
Anthropic披露,未发布的研究版Claude把黎曼猜想相关零点比例下界从41.6%推高到67.2%,但猜想本身仍未证明。这套结果建立在其他数学家近两年的工作之上,验证目前只到Anthropic内部数学家加两位外部专家短评,还没走完同行评议。想靠这个案例判断AI已具备独立科研能力,证据还不够。

ChatGPT Business加一档125美元座位,补的是被Claude抢走的重度用户
OpenAI为ChatGPT Business新增Premium座位,售价125美元/月(年付100美元),提供5倍用量并取消五小时限制,可与25美元的Standard座位混搭。这更像是对社区长期抱怨和Claude Team对标方案的补课,而非主动创新,命中用量上限后仍要靠credits续费的老问题也未必真正解决。

32毫秒还是168毫秒?英伟达开源TTS的基准数字打架了
英伟达发布开源语音合成模型Magpie TTS新版本,称B200上首字节延迟低至32毫秒,主打自部署可控的多语言语音方案。但对照英伟达自己另外几篇技术文章会发现,Hugging Face开放权重和NIM生产部署其实是参数、语言数不一致的两个制品,32毫秒和168毫秒也不是同一件事。开发者部署前最好自己重新测一遍,别直接照搬官方跑分。

OpenAI财务部两年冲刺:合同量涨5倍,但'零日结账'还没到账
OpenAI财务负责人自述两年内建成'AI原生财务团队',喊出'零日结账'的目标,但文中最扎眼的两个数字——合同处理量涨5倍、IR-GPT处理200多次投资人问答——其实来自另一份更晚发布的PwC联合公告,而'零日结账'本身连OpenAI自己都承认还在路上。这套叙事对没有自研大模型的普通企业CFO,可复制性存疑。

剂量说错、药寄多了:Kinney药房AI客服栽了,但只撤回一半
佛蒙特州连锁药房Kinney Drugs因数百起投诉,叫停AI电话助手Burt处理来电续药,恢复老式按键菜单,但保留了Burt发送续药短信的权限。公司把危机定性为“体验问题”而非隐私或准确性问题,回避了对AI可靠性和供应商责任更深的追问。

Meta发布300亿参数Muse Glimmer:个人AI走向本地,更强模型权重仍不开放
据Meta及原始报道,300亿参数的Muse Glimmer采用Apache 2.0许可,可下载、微调并在消费级设备本地运行。它让“个人超级智能”有了具体产品形态,也显示Meta正在分层开放AI能力:用户可以拥有较小模型的权重,更强的Muse Spark仍由公司控制。现实门槛仍是硬件、速度和任务可靠性,普通Mac或PC未必能顺畅运行。

扎克伯格写了6500字,真正想拿到的是数据中心的社会许可
扎克伯格在《未来属于每个人》中继续鼓吹公众接触“超级智能”,并把Meta的数据中心扩张与能源、补水、就业承诺绑在一起。个人AI或许会更普及,但谁拥有模型、算力和入口,决定了这份普及最终更像权利,还是一份平台租约。

GPT-5.6 Sol闯金融最后一公里:PPT产出100%,专业过关仅43.3%
Model ML把GPT-5.6 Sol扩大用于金融研究、建模和PPT/Excel交付,自建Composite评测显示PPT专业审阅达标率43.3%高于Opus 5的26.7%,但Excel关键输出全对率反而从60%掉到50%。这说明模型在完成率和正确率上并不同步领先,金融机构的最终复核责任没有因此减轻。

AI巨头想踩刹车?一篇论文算出:监控太准,谁都不敢先停
智库IFP开出23条政策建议,想给AI研发自动化装上刹车和仪表盘;但MIT与哥伦比亚大学的博弈论研究戳破一个常识——监控越精确,两家AI公司反而可能因为都想当'第二个停下的人'而更难协调减速,透明度不到临界点,只会拖长竞赛。

游艇没听到求救信号那天,扎克伯格写了6500字AI普惠宣言
扎克伯格发布6500字长文,宣称超级智能将免费普惠所有人,但同期AI代理已出现越权黑客事件,Meta智能眼镜正面临国会质询、得州总检察长调查和隐私诉讼,140亿美元级数据中心也陷入社区利益纠纷。开放权重和免费算力听起来是分权,实质上基础设施、数据管道和规则制定权仍全部握在Meta手里。