人工智能资讯 第61页
聚合当前分类下的最新内容,按时间顺序查看第 61 页精选文章。

本地模型接上 OpenAI 接口:0.1a0 插件测的不是兼容,是日志
Simon Willison 发布 llm-chat-completions-server 0.1a0,把本地已装的 LLM 模型统一包成 OpenAI Chat Completions 兼容接口。插件真正要测试的是 LLM 0.32rc1 新增的内容寻址日志,而不是接口兼容本身。OpenAI 消息格式早已是本地推理生态的常见外壳,这次的新意在验证日志去重,不在多一个兼容层。

AI 正在长出自己的界面语言,但不是每一处都能留下
设计师 Jim Nielsen 发现,流式吐字、闪烁等待态、瘦身细线图标正从 Claude、Codex、Cursor 这类 AI 聊天产品外溢到更多软件界面。闪烁等待态对应“等待”这个通用场景,更可能留下来;流式文本、米色配色更像这一波的表层跟风。AI 桌面应用图标比 Finder、Photos 细弱一大截,但这笔账部分要算在 Electron 头上,不能全推给“AI 美学”。

库克暗示 iCloud+ 将提供 AI 额度升级,Siri 的下一道考题是值不值得付费
库克在财报电话会上确认,苹果考虑让用户通过 iCloud+ 购买更高的 Apple Intelligence 与新版 Siri 使用额度,但价格、额度和上线时间仍未公布。新版 Siri 计划随 iOS 27 于秋季广泛推出,苹果想把服务器算力接入服务收入体系。问题很直接:Siri 必须先证明自己足够好用,额度分层才有资格成为一门生意。

审稿人自曝:22篇论文15篇引用造假,两篇伪造作者仍获口头报告
两名研究者称,他们2026年夏天为NeurIPS、WACV和ECCV TerraBytes工作坊评审的22篇投稿中,15篇存在虚构引用、伪造作者或明显AI生成痕迹,其中两篇被举报伪造作者的论文仍拿到口头报告资格,只被要求改引用了事。这暴露的不是AI能不能写论文,而是同行评审为什么拦不住未经核实的内容。

AI写文档满嘴文案腔?一份1983年的航空手册标准把违规率砍了72.9%
GitHub开源项目SimpleEnglish把1983年航空业的ASD-STE100简化技术英语标准打包成AI Agent Skills技能,逼大模型按一句不超20词、一词一义、主动语态的规矩写文档。项目自测称在6个Claude模型、96次生成里违规率平均降了72.9%,但这只是自家正则检测器跑出的结果,离STE官方认证和事实准确还有距离。

写政策备忘录不是目的:施奈尔划出AI能不能代写的那条线
施奈尔提出用“工作任务”和“健身任务”区分该不该用AI代写;学生写政策备忘录属于后者,练的是构思和论证过程,不是最终文本;评价方式不变,学生和雇主都没有理由不选效率更高的那条路。

Google把机器人的手脚都接管了,但承认它还跑不快
Google DeepMind发布Gemini Robotics 2,把人形机器人的控制范围从上半身扩展到脚尖到指尖的全身动作,还加了五指精细操作、多机协作和主动安全停车。演示视频里机器人能弯腰取物、拧灯泡、扎垃圾袋,动作确实细了,但Google自己也承认运动速度还没跟上——从演示到能用,这道坎还没跨过。

GPT 5.6 Sol智能体接管真实App 24小时:新增5个用户,收入为零
Bottleneck Labs让智能体Saul用24小时自主经营真实上架的iOS应用GutCheck,给了350美元和一台无权限限制的Mac mini,结果新增5名用户、新增收入为零,唯一能核实的支出是花99.50美元买的50名测试用户。它能读懂代码库、绕开部分技术障碍,却卡在广告账户认证、反机器人拦截和银行登录权限上——说明智能体自主经营企业的瓶颈不在编码能力,而在人类默认掌控的分发和信任链条。

五个月融两轮、估值20亿:Simile在赌什么
合成用户公司Simile五个月内融两轮,B轮20亿美元估值,CVS Health Ventures既是投资人也是标杆客户;同赛道Aaru此前也拿到10亿美元headline估值,钱正在往“合成调研”这个赛道里砸;但公开材料没有一个经营数据能证明这套模拟真的比真人调研更准、更省。

GPT-5.6 Luna 降价 80%,OpenAI 开始把智能和速度分开卖
OpenAI 将 GPT-5.6 Luna 和 Terra 分别降价 80% 与 20%,Sol 标准价格不变,同时推出两倍价格、最高 2.5 倍速度的 Fast mode。真正影响企业账本的,是模型开始按工作流分工:低价模型吞掉批量任务,高价通道专门出售低时延。单价下降不等于总成本同步下降,重试、工具调用和工程改造仍要算进账里。

AI挂坠Friend换代加声音:129美元变249美元,还多一笔订阅费
AI陪伴挂坠Friend重新上架,加了扬声器,能直接开口回话,不再只发文字消息。硬件价格从129美元涨到249美元,另加每月10美元的记忆订阅。它还没回答的问题是:比起手机里的语音AI,这个挂坠到底多给了用户什么。

Meta靠AI批量造应用,真正缺的从来不是写代码的速度
Meta称AI正大幅压缩新应用开发周期,已上线或测试Seller、Forum、Pocket、Instagram Instants及AI睡前故事,还有更多在路上。但过去十年两轮批量造应用——Creative Labs、NPE Team——都没跑出爆款,唯一站住的Threads,5亿月活背后是Facebook/Instagram导流和AI推荐系统共同作用,不能只算AI一功。

17155行代码拆分实验:AI读代码的Token账单降了83%,但只省下4毛钱
一项针对Claude Code生成的15万行Rust应用的重构实验显示,把17155行的单体数据访问层拆成19个文件后,同一功能变更的输入token从159564降到27360,降幅83%。但这次省下的钱只有约4毛钱,重构本身消耗的token上限却高达500万,说明这类实验能证明省钱的方向,还远不能当作可复制的ROI公式。

130万播放、单月佣金超40万:AI保健品广告工厂被告上法庭
保健品公司Humann起诉同行Ambrosia Brands,指控旗下Rosabella用AI生成的“医生”在TikTok Shop批量带货,同月一款辣木粉因耐药性沙门氏菌被FDA召回。诉讼尚未判决,但已经摊开一条AI换脸加联盟分佣的造假流水线,风险集中砸向中老年买家。

LinkedIn上线"疑似AI垃圾"举报按钮,"增强帖子"改写功能同步收回
LinkedIn在帖子菜单加了"疑似AI垃圾"举报按钮,点击后帖子只对举报者本人隐藏,反馈数据用来训练识别模型。平台同时把会改写用户措辞的"增强帖子"换成只校对不改写的版本,呼应今年5月就开始压制"低质泛化内容"的政策。第三方检测显示LinkedIn上疑似AI生成的帖子比例不低,但分类器能不能分清"像AI"和"真是AI",目前还没有答案。

GPU利用率:企业AI的真瓶颈,还是供应商的新故事
Dharma-AI提出:企业AI的瓶颈正从买不到GPU转向用不好GPU,忙碌利用率不等于有效产出。训练、推理、批处理、量化对显存和延迟的要求各不相同,同一套调度逻辑必然错配。这判断部分成立,但出自一家卖专用模型和调度产品的公司,企业真正该盯的是每GPU小时的产出,不是表面占用率。

Gemini Robotics ER 2发布:机器人学会边干边判断,动作还是外包给别人
Google DeepMind发布机器人具身推理模型Gemini Robotics ER 2,核心突破是让机器人边执行边判断进度、决定何时切换步骤。官方给出的57.4%进度分类准确率、91.3%关键时刻识别准确率均来自自有评测,还没有开放场景或第三方验证。ER 2负责理解和调度,机械臂怎么拧螺丝、轮子怎么走位,仍要交给底层VLA模型或专用API去做。

MCP协议“去状态化”:企业级AI Agent部署松了一道锁
MCP在2026年7月28日发布最大版本更新,协议核心从绑定单一服务器的有状态会话改为无状态请求响应,并首次引入至少12个月的功能弃用缓冲期。这解决的是横向扩展和故障恢复的架构瓶颈,不代表安全、权限治理和生态兼容性问题已经解决,企业团队评估接入前仍需核查授权与审计能力。

全美仅2000人,AI巨头正在疯抢这类工程师
猎头公司Christian & Timbers估算,全美具备成熟落地能力、能稳定为企业创造数千万美元AI回报的前线部署工程师(FDE)总共只有约2000人,而计划招聘这类人才的企业比例已从年初的5%-10%涨到二季度末的70%。这轮抢人潮说明,AI行业当下真正稀缺的不是模型本身,而是能把技术嵌进业务、扛住ROI结果的人,但这份紧俏更像自动化成熟前的一段窗口期。

Prized让运营自己造工具,权限钥匙仍握在IT手里
YC S26项目Prized让运营、客服、财务团队用自然语言生成内部工具,读写权限锁在管理员预先审批的连接器里。它卖的不是生成速度,是把AI生成的应用装进企业已有的权限体系。数据是否入模、密钥怎么存、能不能私有部署、定价多少,官网demo都没给答案。

AI只管读,规则说了算:一家合规公司拿下1500万美元
美国基建合规公司Dili完成1500万美元A轮融资,累计融资2170万美元,已被约700个制造和数据中心项目采用。它的关键设计是把大模型限制在读材料这一层,最终合规判断交给确定性规则系统,这条边界比“AI合规”这个概念本身更值得琢磨。