人工智能资讯 第2页
聚合当前分类下的最新内容,按时间顺序查看第 2 页精选文章。

OpenAI给得州写了封信,却没提一个数据中心
OpenAI 2026年8月10日公开信件,承诺与得州州长、地方政府、公用事业公司合作建设AI基础设施,但没写地点、投资额、用电规模和时间表。这更像州级政策表态而非项目落地,能不能兑现要看电网和社区利益谈不谈得拢。得州居民该盯用电协议和补偿方案,投资者该把这封信当意向而非合同。

书名停留在RLHF,内容已经讲到CISPO,这本后训练教材该怎么读
Nathan Lambert的后训练教材正式出版,书名停留在RLHF,内容已更新到GSPO、CISPO和在策略蒸馏;全文在线版、12小时课程、代码和练习全部免费,纸质书需单独付费;真正的卖点不是算法公式,是训练读者判断一项新研究能否在3到9个月内落地的眼力。

至少13个安保机器人项目终止,负债2.73亿的Knightscope转头雇人
Proof News追踪的21个安保机器人部署里,至少13个已经终止;负债2.73亿美元的Knightscope收购了一家真人保安公司,转向人机协作;机器人卡在导航、沟通、识别、临场处置这几件事上,记录和威慑仍是它目前最可靠的价值。

AI一天猜千次芯片材料,900万美元赌不动的却是湿实验室速度
AI材料发现初创公司Discovered Materials完成900万美元种子轮,用Anthropic模型驱动的agent集群一天能跑出数千次材料猜测,效率远超真人博士。但领投人和创始人自己都承认,真正卡住行业的不是发现候选材料,而是没法用AI加速的湿实验室合成与专利落地环节。

福特AI助手能查胎压,新闻没讲清的是它到底新在哪
福特给手机App加了个AI助手,能用自然语言查油量和胎压,但这两项数据特斯拉、Rivian、GM早就能查。福特官网目前也查不到车型范围和上线细节,真正的卖点其实是对话层,不是数据本身。

Meta「发布」开源模型Muse Glimmer?三个细节对不上号
一篇文风专业的Meta开源模型通稿,宣称推出300亿参数本地智能体模型Muse Glimmer并采用Apache 2.0协议,但命名空间、许可证类型、命名历史三处细节都和Meta以往的做法对不上,且查不到任何第三方复现或社区讨论。在官方渠道确认之前,这条「重磅开源」更像一份待验证的文本,不宜直接当新闻转发。

把蒸馏显存砍一半的论文,却查无此文
Multiverse Computing称用离线Top-K缓存加分块KL损失,把大模型知识蒸馏的显存峰值从约250GB压到约128GB,宣称单卡H200就能做长上下文蒸馏。但独立核实发现,这篇被反复引用的论文编号、代码复现结果和下游质量数据都缺乏可验证信息,该公司过往的招牌技术CompactifAI又是完全不同的路线,读者对这类效率突破叙事应多留一分审慎。

Claude公开系统提示词:出口管制事件被写进模型回答规则,真正变化是什么
Anthropic在Claude Opus 5的公开系统提示词中,专门写入Fable 5和Mythos 5因美国出口管制暂停、恢复访问的时间线,并要求模型如实承认这段经历。它解决的是模型如何回答已知事件,不代表API、地区可用性或后续政策已经完全透明,开发者仍应以官方服务状态和公告为准。

GitHub Models 已退役:别把免费 AI 网关当基础设施
GitHub Models 已完成退役,依赖它调用模型的 GitHub Actions 工作流会直接失败。官方没有解释原因,Agent 带来的调用量和成本压力只是一种合理猜测。真正该吸取的教训是:统一 API 省下了接入时间,也可能把认证、计费和运行稳定性一起押给平台。

一年20起申请的冷门法条,被AI'撑爆'了
《经济学人》最新一期用'公地悲剧'形容英国的就业仲裁法庭:一项过去一年仅有约20起申请的紧急法律条款,如今被AI相关案件搞得拥堵不堪。真正被耗尽的公共资源,可能不是数据或算力,而是行政和司法系统留给'很少有人会用'的处理能力。

一个指向未来的日期,让AI核查当场露馅
Hacker News惯例月度帖《Ask HN: What are you working on?》标注日期为2026年8月,早于现实时间;试图用联网检索核实帖中项目时,工具没有找到独立信源,反而自行生成了一套看似专业的技术点评。这提醒做深度报道时,检索结果本身也需要先核实来源,不能默认为可靠证据。

Zoox本周开始收费,但那份豁免批文联邦公报还没确认
亚马逊旗下Zoox将从8月10日起在拉斯维加斯对机器人出租车收费,靠的是NHTSA一份允许其运营2500辆无方向盘车辆两年的豁免,但翻查联邦公报公开记录,截至发稿仍未见官方批准文件,报道时间线跑在了监管程序前面。更关键的是,Zoox的300万英里数据体量和Waymo的2.2亿英里差了近70倍,合法上路和让乘客真正信任之间,还有很长一段路。

硅谷读错了科幻——普利策历史学家点名马斯克
哈佛历史学家Jill Lepore在新书《The Rise and Fall of the Artificial State》中提出,私营科技公司正在悄悄接管国家职能,她称之为“人造国家”。她的核心判断是:这不是技术决定的宿命,而是一连串可追溯的制度选择,因此也可以被拆解。

那段疯传的'AI接管预言',其实是一场氯胺酮隔离舱幻觉
网站Kibotronics重发了神经科学家John C. Lilly 1978年描述'固态实体接管地球'的文字,被不少人当作AI风险的早期预言转发。但版本考据显示,这段文字最初定位是'小说化自传','形而上学自传'的标签是十年后再版时才贴上去的营销措辞,原文也完全隐去了它诞生于隔离舱注射氯胺酮状态下的关键背景。

Claude写的网站,复现了一个已修复的bug
独立开发者Terry Godier用Claude一次性生成了天文观测网站Dark Hours,一天后被原开源项目DarkHours.app作者Miguel Beher指出撞脸,关键证据是他的版本复现了对方早已修复的一个定位bug。Godier一小时内道歉、重定向域名、放弃iOS版,但AI是如何'看到'一个已经消失的bug,至今没有答案。

43%美国教师用AI检测器判作业,报告定不了作弊
美国43%的六至十二年级教师已在用AI检测器判断学生作业是否由机器写成,但这类工具靠模型猜测而非数据库比对,判断依据通常不公开。传统查重能逐句展示重合内容,AI检测做不到,却越来越多被当成处分依据。真正的风险不是工具本身,而是学校把一个概率信号,当成了能定性的证据。

从9阶纪录到任意 n>3 阶:AI辅助找到幻方六边形构造,证明仍待复核
开发者 Sergey Gukov 称,他借助 GPT-5.6 Sol 和自定义求解器,为任意 n>3 阶异常反对称连续幻方六边形找到了构造方法,并公开代码与候选证明。真正有分量的进展是把计算搜索收束为一般构造,但证明尚未经过 Lean 形式化或独立复核,目前不能当作已确认的数学定理。

编码提速55.8%还是变慢19%:两份AI效率研究互相打脸
一篇博文反驳"代码不是难点"的流行说法,但这场辩论其实可追溯到Fred Brooks 1986年的《没有银弹》。更值得关注的是两份实证研究的正面冲突:GitHub Copilot在绿地任务中提速55.8%,METR却发现资深开发者维护成熟代码库时反而慢19%,AI没让难点消失,只是把它挪了地方。

丹麦高中生要当面答辩作业:一场被包装成'新规'的试验
丹麦教育部宣布,约9000名HF高中生的书面作业将新增口头答辩环节,并配合屏幕监控和防火墙应对AI作弊。但对照原始信源会发现,这更像聚焦大型作业的一场试验,而非通稿描述的全面强制新规,监控技术本身也存在绕过和合规风险。

DeepMind开源飓风模型:多赢一天预警,答不出的是快速增强
DeepMind开源的WeatherNext飓风模型用更低分辨率数据把预警提前了约一天,在飓风Melissa上首次让美国国家飓风中心提前五天预判五级强度。但气象界真正的考题是能否稳定捕捉'快速增强',这个模型至今没有给出确定答案。

提问量跌98.5%:一份报告想证明AI正在“杀死”六个网站
创业公司HarperFlow发布《死亡互联网报告》,称Stack Overflow月度新增提问量较ChatGPT发布前暴跌98.5%,并把Chegg、Shutterstock、Fiverr、Quora、Getty的下滑一并归因于AI。但报告混用提问数、股价和维基百科浏览量三种口径,六合一的因果结论并不成立,真正能确认的只是部分需求正在被AI截走。