人工智能资讯 第40页

聚合当前分类下的最新内容,按时间顺序查看第 40 页精选文章。

智谱认领Ox Alpha:登榜之后,开源权重才是真考题
人工智能 2026/8/26

智谱认领Ox Alpha:登榜之后,开源权重才是真考题

彭博社8月26日报道,智谱旗下Z.ai确认匿名登上使用榜单的Ox Alpha是新一代GLM模型,并称当晚放出权重。免费好用不等于开源权重、许可证、部署成本都已经过关。开发者能否复现效果、企业能否拿到商用授权,得等权重和文档真正落地再看。

Ox Alpha智谱GLM
编程终结论重燃:厂商说效率涨50%,独立研究说反而慢19%
人工智能 2026/8/26

编程终结论重燃:厂商说效率涨50%,独立研究说反而慢19%

一条Mastodon吐槽帖怼上Hacker News热帖“编程终结论”,但真正值得看的不是谁嘴硬,而是双方都没拿出的数据:厂商晒出效率暴涨的漂亮数字,METR等独立研究却发现资深开发者用AI反而更慢。两套证据都真实,却指向两个完全不同的现实。

AI编程编程智能体开发者生产力
六级RAG架构清单:多数团队只需要第一级
人工智能 2026/8/26

六级RAG架构清单:多数团队只需要第一级

多数RAG系统一上来就奔向embedding和向量数据库,但Lighthouse Newsletter给出的六级分级框架说明,BM25加查询重写能覆盖大部分场景,真正决定该往哪一级走的是语料变动率和查询量,不是团队想不想显得先进。文章补全了原文没讲完的三级重型架构,也暴露了这套经验之谈缺第三方验证的短板。

RAG六级RAG架构BM25
AI写了100万行代码,却被Rust自己的漏洞打了脸
人工智能 2026/8/26

AI写了100万行代码,却被Rust自己的漏洞打了脸

Paul Dix那句被疯转的'AI写了100万行可靠代码',说的其实是Bun把核心实现从Zig迁移到Rust的一次具体工程,靠的是旧代码做参照、64个AI代理并行、6万+测试和11轮审查兜底。但重写完成后,Rust版本里被曝出一处unsafe导致的悬垂引用漏洞,直接打脸了'换语言=更安全'的核心卖点。

AI代码生成BunRust
Ringg再融1550万美元:甩掉的不是电话,是低价外呼
人工智能 2026/8/26

Ringg再融1550万美元:甩掉的不是电话,是低价外呼

Peak XV追加1000万美元,Ringg的A轮总额升至1550万美元。语音业务仍占七成以上,真正收缩的是低价外呼那一段,公司把重心挪去KYC核身、预约、客服这类高粘性工作流。护城河不在语音模型强弱,在谁能占住企业不愿意换掉的那部分工作。

Ringg语音AI智能体平台
两个月估值涨五成:机器人公司Generalist的30亿美元,谁来验证?
人工智能 2026/8/26

两个月估值涨五成:机器人公司Generalist的30亿美元,谁来验证?

机器人基础模型公司Generalist在两个月内完成一轮约2亿美元的追加融资,估值从20亿美元跳到30亿美元,由8VC领投,公司尚未正式官宣。支撑这个估值的技术指标全部来自公司自评,尚无第三方评测或公开点名的付费客户。

Generalist机器人基础模型具身智能
Claude不再失忆,代价是默认记住你
人工智能 2026/8/26

Claude不再失忆,代价是默认记住你

Anthropic把Claude Chat和Cowork的记忆系统打通,用户不用再重复交代背景,默认排除敏感信息但可手动开启。但官方文档也承认,高层级摘要仍可能带出敏感内容,'默认安全'更像是靠用户自己动手删、动手关。

Claude记忆系统Anthropic
OpenAI把 ChatGPT Work 与 Codex 的管理员操作做成了插件,权限边界仍是关键
人工智能 2026/8/26

OpenAI把 ChatGPT Work 与 Codex 的管理员操作做成了插件,权限边界仍是关键

OpenAI推出 Admin plugin,允许 ChatGPT Work 与 Codex 的管理员分析工作区使用情况、管理成员和权限、调整额度,并处理管理员请求。它的意义不在于多了一个聊天入口,而在于 AI 开始接触组织级权限与资源配置;但公开信息尚不足以证明它具备完整的审批、审计和回滚能力,企业不应把“可执行”直接等同于“可放权”。

OpenAIChatGPT WorkAdmin plugin
以色列的百万美元'智库':写给ChatGPT看,不是给人看
人工智能 2026/8/26

以色列的百万美元'智库':写给ChatGPT看,不是给人看

美国公关公司Piro Inc.代以色列政府运营的Hanover Institute,一个月内发布上百篇AI写作的'研究报告',唯一读者其实是抓取网页的AI模型。FARA披露的百万美元合同和多组AI检测结果,让这场舆论战第一次有了具体的价格和证据链,但目前能证明的只是检索层的内容植入,而非模型训练层面被'投毒'。

AI内容操纵大语言模型Hanover Institute for Public Policy
一篇被当成暗黑寓言读的小说,写中了英国监管者正在忧虑的事
人工智能 2026/8/26

一篇被当成暗黑寓言读的小说,写中了英国监管者正在忧虑的事

英国作家Rory McMeekin的短篇小说《My Friend Aaron》讲述一个成瘾型人格的年轻人搭建自家预测市场、最终被AI代理操纵成真人秀式暗杀标的的故事;这个虚构极端场景,几乎逐条对应英国Gambling Commission和FCA在2026年对预测市场'按实质监管'的现实辩论。判断:小说的想象力已经跑到了监管条文前面。

AI代理预测市场人工智能操纵
Instagram甩出自动剪辑新功能,却死活不认这是AI
人工智能 2026/8/26

Instagram甩出自动剪辑新功能,却死活不认这是AI

Instagram在Threads账号上悄悄公布了自动初剪功能First Draft,先上iPhone端,能去停顿、拼精彩片段,但Meta坚称这不是AI。这套说法和它跟TikTok、YouTube几乎同款的效果放在一起看,更值得关注的其实是Meta想用它串起的一整条创作者留存链路。

自动视频剪辑First DraftInstagram
Waymo进军慕尼黑,起跑线上写着零许可
人工智能 2026/8/26

Waymo进军慕尼黑,起跑线上写着零许可

Waymo官宣将Robotaxi开进慕尼黑,目标2027年底商业化载客,但德国的审批体系是测试许可、运营许可、州级区域许可三层递进关卡,Waymo现在一张都没拿到。相比大众43辆、Mobileye4辆的L4测试车队,它是彻底从零起步,2027只是一个待验证的时间表。

WaymoRobotaxiL4级自动驾驶
AI没有取代放射科医生,却正在改写这份工作的门槛
人工智能 2026/8/26

AI没有取代放射科医生,却正在改写这份工作的门槛

2016年Geoffrey Hinton曾判断,AI将在五年内取代放射科医生;十年过去,医生没有消失,但影像AI已经进入诊断流程。截至2026年初,FDA相关医疗AI设备约1400款,其中约四分之三面向放射学,真正拉开差距的将是医生识别错误、推翻模型和管理风险的能力。

医疗人工智能放射学医学影像
Gamma收购Lica:两位创始人进入研究团队,产品整合仍待确认
人工智能 2026/8/26

Gamma收购Lica:两位创始人进入研究团队,产品整合仍待确认

Gamma收购了Accel支持的设计初创公司Lica,两位联合创始人将加入Gamma新设的研究团队。现有信息更支持将其视为一次能力和人才补充,而非成熟产品线并购;交易真正的分量,要看Lica技术能否进入Gamma产品,以及原有用户如何安置。

GammaLicaAI演示文稿
HN一半头条是AI写的?这个数字本身经不起细算
人工智能 2026/8/26

HN一半头条是AI写的?这个数字本身经不起细算

科技博主lcamtuf抽样统计发现,Hacker News每日Top5中AI相关内容占比从2月的40%涨到6月的50%~60%,判定工具是AI检测器Pangram。但检测器官方标称的极低误报率,并不能直接换算成'标记结果里真是AI写的比例',HN社区已经出现教师原创文章、2013年人类科幻小说被误判的具体案例。

AI检测人工智能生成内容误判与误报
通义千问预告Qwen3.8-Flash-Next:抢先挂上Qwen4架构,规格仍是空白
人工智能 2026/8/25

通义千问预告Qwen3.8-Flash-Next:抢先挂上Qwen4架构,规格仍是空白

通义千问在ModelScope预告Qwen3.8-Flash-Next,称基于下一代Qwen4架构,预计2026年8月26日15点UTC发布多模态MoE与FP8两个版本。参数规模、上下文长度、许可证、跑分全部空缺。这次提前下放更像占位公告,含金量要等权重和基准数据落地才能验证。

Qwen3.8-Flash-NextQwen4通义千问
OpenAI 产品主管谈智能体:用户准备好了,产品还要证明自己值得托付
人工智能 2026/8/25

OpenAI 产品主管谈智能体:用户准备好了,产品还要证明自己值得托付

OpenAI 产品主管 Thibault Sottiaux 在 TechCrunch 专访中把智能体、交互体验和产品落地放在同一条主线上,并判断市场已经准备好接受能代替用户执行任务的 AI。真正的门槛却不在演示效果,而在任务成功率、权限控制、人工接管和责任追溯;这些指标尚未充分公开,企业也不会只凭用户规模买单。

OpenAIChatGPT Work自主执行任务
4-bit模型赢了BF16,却没赢过它真正的对手
人工智能 2026/8/25

4-bit模型赢了BF16,却没赢过它真正的对手

Multiverse Computing称把GPT-OSS 120B压缩到60B再量化到4-bit后,用QAH方法愈合的模型在9项基准里赢了自己的全精度版本7项。但真正的对照组是那个未压缩的120B原始模型,多数基准上QAH仍落后,长上下文差距高达7分以上,训练稳定性上的发现反而更实在。

大模型量化GPT-OSS 120B模型压缩
Rewind停止录屏之际,一个22星小项目选了最保守的记录方式
人工智能 2026/8/25

Rewind停止录屏之际,一个22星小项目选了最保守的记录方式

开源项目ambient-context只读取当前窗口的文字并写进本地Markdown文件,不截图、不联网,专给Claude Code这类agent当记忆库;它出现的时间点恰好是Rewind AI停掉持续屏幕录制、Limitless被Meta收编收缩硬件之后,屏幕记忆赛道正处在头部玩家退场的空窗期。

ambient-contextClaude Code屏幕记忆
让AI别睡觉:Headlong每小时烧1到2美元,值不值
人工智能 2026/8/25

让AI别睡觉:Headlong每小时烧1到2美元,值不值

Laude Institute开源了agent框架Headlong,核心是让AI在没人搭话时也不停自我生成思考,而不是靠cron定时唤醒。团队自曝这套持续agency每小时成本1到2美元、单线程共享意味着守不住秘密,四档Docker沙箱里两档被官方自己标为高风险。这更像一次诚实的研究实验,还没到能塞进生产流程的地步。

HeadlongAI Agent持续自主智能
斯坦福最新研究:AI没裁掉年轻人,只是悄悄关掉了招聘入口
人工智能 2026/8/25

斯坦福最新研究:AI没裁掉年轻人,只是悄悄关掉了招聘入口

斯坦福数字经济实验室用ADP真实工资数据追踪发现,22-25岁员工在AI高暴露职业中的就业水平比同龄人预期落后19%,且这个数字过去一年从13%一路上修。更关键的是,这场冲击不靠裁员实现,而是企业悄悄减少了校招名额,这意味着常规失业率指标根本捕捉不到它。

人工智能对就业的影响青年就业AI职业暴露度