人工智能资讯 第39页

聚合当前分类下的最新内容,按时间顺序查看第 39 页精选文章。

DeepMind 要试点“双盲 AI 评测”,但谁被蒙在鼓里还没说清
人工智能 2026/8/27

DeepMind 要试点“双盲 AI 评测”,但谁被蒙在鼓里还没说清

材料称 Google DeepMind 将于 2026 年 8 月 27 日宣布试点其所谓“全球首次”双盲 AI 评测,但未提供方法、样本、执行机构或结果。双盲有机会削弱品牌偏见,却无法自动解决利益冲突、测试集污染和选择性披露。没有透明协议、独立监督与复现入口,这仍是一项待核验的试点宣称。

双盲AI评测Google DeepMindAI评测
Photoshop新标注功能悄悄接入Gemini,Firefly的安全牌还灵吗
人工智能 2026/8/27

Photoshop新标注功能悄悄接入Gemini,Firefly的安全牌还灵吗

The Verge一篇标题党式报道背后,Adobe其实用了半年时间把AI Assistant和AI Markup铺进Photoshop的网页、移动、Firefly Editor和桌面Beta四个平台;真正的新闻不是“又加AI”,而是桌面版最新的Markup功能已经兼容Gemini,这和Adobe一直靠Firefly“商业安全+版权赔偿”卖订阅的说法出现了缝隙。

AdobePhotoshopFirefly
睡眠打了71分,这个法官自己从没被审过
人工智能 2026/8/27

睡眠打了71分,这个法官自己从没被审过

The Verge编辑写了篇法庭体专栏,吐槽Pixel Watch给露营夜打出71分,要求改判80分。但真正的问题不是分数冤不冤,而是这套从未公开权重、也从未被独立验证过的算法,凭什么给你的睡眠下判决书。

睡眠评分算法算法透明度Pixel Watch
英伟达129亿美元收购Hugging Face,协议未签、算盘先明
人工智能 2026/8/27

英伟达129亿美元收购Hugging Face,协议未签、算盘先明

英伟达据报道已同意以约129亿美元收购开源AI平台Hugging Face,但协议尚未正式签署,交易仍可能生变。这笔收购真正的目标不是Hugging Face一年1.5亿美元的收入,而是英伟达借它锁住开源AI生态入口,对冲客户自研芯片的风险,同时重新切入云计算业务。

英伟达Hugging Face开源人工智能
开发者被裁做出AI CEO?这故事很燃,但一个证人都没有
人工智能 2026/8/27

开发者被裁做出AI CEO?这故事很燃,但一个证人都没有

开源项目OpenExecutive用8个Claude智能体拼出一个“虚拟高管”,故事包装成开发者被AI裁员后的反击,但裁员的公司、规模、当事人全部查无实据。项目自己的发布日期也前后矛盾,真正该关注的是审计挖出的记忆检索缺陷和安全短板,而不是这个爽文开头。

OpenExecutiveClaudeAI高管团队
6B激活参数背后,Qwen在预告Qwen4的架构底牌
人工智能 2026/8/27

6B激活参数背后,Qwen在预告Qwen4的架构底牌

Qwen3.8-Flash-Next表面是又一个开源模型,总参数125B却只激活6B,官方明说这是Qwen4架构的早期预览。把它的注意力混合、门控残差、N-gram记忆和超稀疏MoE路由拆开看,再对照自报跑分里的胜负与限度,能看清这次开源阵营下一步想怎么打。

Qwen3.8-Flash-NextQwen4大语言模型
代码涨220%、功能只涨36%:Meta的AI裁员计划栽在自己的数据里
人工智能 2026/8/27

代码涨220%、功能只涨36%:Meta的AI裁员计划栽在自己的数据里

Meta内部代号Project OT的重组计划,今年1月从夏威夷高管闭门会议提出,设想裁员最高60%、用AI agent接管日常工作,但5月执行首轮裁员后,11月的第二轮被扎克伯格取消。真正让计划急刹车的,不是AI不够炫,而是Meta自己拿来证明AI好用的内部数据——代码改动暴涨220%,事故和返工却跟着涨了40%到70%。

MetaProject OTAI agent
谷歌给Gemini拆了三块牌子,拆出来的其实是订阅墙
人工智能 2026/8/27

谷歌给Gemini拆了三块牌子,拆出来的其实是订阅墙

Google给Gemini语音功能又添了品牌名,Chat、Spark、Daily Brief各占一块地盘,用户得先猜该用哪个;但真正值得留意的不是命名混乱,而是Daily Brief背后跨源数据推断、留存不可撤回的隐私协议,以及Spark绑Pro、Daily Brief绑Plus的订阅分层——品牌拆分,更像是给付费墙找了个体面的名字。

GeminiGoogleDaily Brief
普通ChatGPT辅导:练习分猛涨48%,独立考试却跌17%
人工智能 2026/8/27

普通ChatGPT辅导:练习分猛涨48%,独立考试却跌17%

OpenAI新报告称每周有数亿条课业相关对话,但这些数字与该公司另一份官方报告口径不一致。更关键的是,学术界的随机对照试验发现,普通ChatGPT能让学生练习时表现暴涨,却让独立考试成绩下滑,只有专门设计引导式提示的版本才能避免这种假进步。

ChatGPTOpenAI人工智能教育
30万教师免费用上ChatGPT,OpenAI瞄准的是学区的采购流程
人工智能 2026/8/27

30万教师免费用上ChatGPT,OpenAI瞄准的是学区的采购流程

OpenAI把ChatGPT for Teachers扩大到55个学区、20个州,新增超10万名教职员工,累计覆盖100多个K-12机构、30个州、30万教师,免费用到2028年6月。16州统一了数据隐私协议,但这不等于自动合规,学生也没有直接使用权限。真正该盯的是免费期满后怎么收费,谁先定义了学校用AI的标准。

OpenAIChatGPT for Teachers教育人工智能
Google转录AI能自动删“嗯啊”,但准确率至今是个谜
人工智能 2026/8/27

Google转录AI能自动删“嗯啊”,但准确率至今是个谜

Google为Gemini 3.5系列新增专用转录模型,Smart模式能自动清理“嗯”“啊”等填充词并重组语序,但官方文档没有公布任何准确率数字,还承认这一模式无法和说话人分离、词级时间戳同时开启。转录稿变好读了,逐字可验证性却打了折扣,这是原文标题完全没提到的代价。

GoogleGemini 3.5AI语音转录
对冲基金买单的播客AI情报,连自己都不敢担保准确率
人工智能 2026/8/27

对冲基金买单的播客AI情报,连自己都不敢担保准确率

Particle推出播客搜索引擎Radar,转录超13万档播客并开放给AI代理调用,对冲基金已是最大付费群体。但公司自身条款承认内容抓取可能未获授权、从未公布转录准确率,却把产品卖给最看重数据精度的金融客户。

ParticleRadar播客搜索引擎
百万小时视频训出机器人大脑,工厂凭什么敢用?
人工智能 2026/8/27

百万小时视频训出机器人大脑,工厂凭什么敢用?

两位前Meta FAIR科学家创办的Perceptron发布开放权重工业视觉模型Isaac 0.5,称能让机器人统一完成感知、推理、行动,训练靠100万小时通用视频加第一视角、UMI和机器人轨迹数据。公司自称定位卡在通用基础模型与单任务模型之间,但没给基准测试、推理成本和硬件门槛。开放权重值得肯定,可离产线验证还差一整套证据。

Isaac 0.5工业机器人具身智能
单卡训14.5小时碾压所有检索模型?这笔账没那么好算
人工智能 2026/8/27

单卡训14.5小时碾压所有检索模型?这笔账没那么好算

Sentence Transformers v6.0 新增 MultiVectorEncoder,作者称单卡 RTX 3090 训练 14.5 小时的医疗检索模型碾压了所有通用检索器。但评测所用 MIRIAD 数据集词汇重叠偏高,且模型训成后仍需额外的索引基础设施才能部署——训练降本不等于检索系统降本。

多向量检索MultiVectorEncoderSentence Transformers v6.0
Z.ai认领Ox Alpha,「吊打Claude」的传言先破了功
人工智能 2026/8/26

Z.ai认领Ox Alpha,「吊打Claude」的传言先破了功

身份揭晓当天,Z.ai承认Ox Alpha就是GLM-5.3-Flash的一次stealth投放,但社交媒体传的「10个任务80%胜率吊打Claude/GPT」被113个任务的独立测试证伪,免费预览通道也同步归零。真正的看点不是猜身份,是这套先炒作再收割的打法有多熟练。

Z.aiGLM-5.3-FlashOx Alpha
GLM-5.3-Flash:标题像模型,正文却在讲太阳系
人工智能 2026/8/26

GLM-5.3-Flash:标题像模型,正文却在讲太阳系

一个页面把“GLM-5.3-Flash”写在标题里,正文却偏离到太阳系,模型是否真实发布、参数和跑分是否可信,目前都不能仅凭页面确认。真正值得警惕的是信息抓取链路失真:开发者、采购团队和 AI 搜索工具都可能把错配内容当成模型资料。

GLM-5.3-Flashz.aiAI模型
一枚AirTag,拆穿了亚马逊的拆书流水线
人工智能 2026/8/26

一枚AirTag,拆穿了亚马逊的拆书流水线

404 Media用一枚AirTag追踪一批近千本书的订单,查到亚马逊在拉斯维加斯的仓库正批量切除书脊、扫描并销毁纸质书用于AI训练。亚马逊官方回应只说'购买书籍改进产品',刻意回避了训练用途、规模和被剔除书籍的下落。仓库员工的说法显示,这条链路管理混乱,书籍来源也远比'稀有书'复杂。

亚马逊AI训练书籍数字化
Arga Labs融资千万美元,但AI代理训练沙盒早已挤满对手
人工智能 2026/8/26

Arga Labs融资千万美元,但AI代理训练沙盒早已挤满对手

Arga Labs为企业软件做数字孪生训练环境,拿到千万美元种子轮,General Catalyst领投。但这个赛道已经有六七家公司在做几乎同样的事,而Arga自己的合规认证、增长数据和产品描述都还留着待验证的口子。

AI代理Arga Labs数字孪生训练环境
QueryStory脱隐首日:卖信任的公司,唯一客户是自己投资人
人工智能 2026/8/26

QueryStory脱隐首日:卖信任的公司,唯一客户是自己投资人

企业AI分析平台QueryStory宣布脱离隐身,主打SQL透明化和置信度指标来解决AI幻觉问题,种子轮估值6000万美元。但公开可查的唯一客户就是自己的投资人,置信度指标也未经统计校准,这家卖'信任'的公司自己的可信证据链条相当单薄。

QueryStory企业AI分析平台AI幻觉
IBM Granite 4.2:不比模型强,比部署稳
人工智能 2026/8/26

IBM Granite 4.2:不比模型强,比部署稳

IBM发布Granite 4.2开放权重模型,3B/8B/30B三档统一支持128K原生上下文;但只有8B、30B接受了专门的智能体强化训练,3B的工具调用能力打了折扣。IBM这次没打算刷榜,赌的是企业要的可控成本和数据自主,只是许可证细节和实测数据仍是空白。

Granite 4.2IBM本地部署
盖茨罕见认怂:这次他不确定创新能兜底
人工智能 2026/8/26

盖茨罕见认怂:这次他不确定创新能兜底

比尔·盖茨发布近六千字长文并密集接受多家媒体采访,首次以本人名义系统警告AI风险,提出机器人税、人类保留岗位等具体政策;但他最耸动的判断——大规模永久失业、坏结果迫在眉睫——目前更接近政策修辞,独立学术评估的证据支撑并没有跟上。

比尔·盖茨人工智能风险AI失业