最新科技资讯 第144页
聚合 AI、科技、商业、硬件与开发工具的最新内容,按时间顺序查看第 144 页精选文章。

扮演AI聊天机器人60秒:一款免费小游戏戳中了公众的AI疲劳
The Verge一篇讲“扮演AI自嘲AI”的报道正文意外丢失,只剩导航栏,但真正的主角其实是免费网页游戏《Your AI Slop Bores Me》:真人限时假扮聊天机器人回答陌生人的请求。它和一款同名撞车的日本Steam游戏内核完全不同,前者的走红更值得留意——它精准踩中了2026年公众对AI生成内容的集体审美疲劳。

格罗滕迪克式孤独封神,证据只值0.067
Sam Altman那句“联合办公杀死好想法”的判断被反复引用,配上数学家格罗滕迪克手稿的传奇,拼成了一套“孤独造就天才”的叙事。但学术界对孵化器和协作效果的系统研究显示,效果普遍很小、高度异质,还深陷幸存者偏差和自选偏差,真正被验证有效的不是孤独本身,而是独立思考与协作评审交替的节奏。

AI制药的成绩单:早期漂亮,Phase II原地踏步
《Nature Reviews Drug Discovery》最新综述指出,AI制药在临床层面的证据仍然'令人失望地有限',关键考验Phase II尚未看到实质突破。拆开具体数字会发现:AI药物Phase I成功率明显高于历史水平,但Phase II成功率与行业基准大致持平,且样本太小、缺乏同期对照,还撑不起因果结论。

Claude水印说明书:Anthropic自曝“全篇重写即失效”
Anthropic在8月15日详解了Claude文本水印的技术细节,承认整篇重写足以让水印失效,这暴露出欧盟透明度监管的技术天花板。放在行业里看,Google才是这项技术的原创方且已在Gemini落地,OpenAI在文本层面至今没有对等承诺,Anthropic更像是被法规推着交作业的一方。

一次编目手滑,如何变成了写进Unicode的汉字
1978年日本JIS X 0208标准里混入了十几个来历不明的汉字,1997年溯源发现多数是剪贴拼接和抄录出错造出来的,只有一个字至今查无出处。这些错误后来随标准继承钻进Unicode,现在几乎成了全球字符集甩不掉的包袱。

上下文拉到128K,Gemini数学准确率反而跌到51%
一篇热议博客提出假说:AI数学表现变强,靠的是远超人脑的外部工作记忆,而非更聪明。但MathHay等基准测试显示上下文越长准确率反而下降,GSM-Symbolic更发现一句无关的话就能让准确率暴跌,说明记忆容量大只是必要条件,不是充分条件。

Elektron 两台入门 groovebox 被低估了:旧设备也能赢在工作流
Model:Samples 负责播放经 USB 导入的采样,Model:Cycles 则使用源自 Digitone 思路的简化 FM 合成引擎。它们接口有限,也保留了 Elektron 的学习门槛,但成熟音序器和较低定位,仍让它们比许多参数更漂亮的设备更接近真正的创作工具。

SpaceX收购Cursor落地:算力并表后,模型中立才是关键
SpaceX于2026年8月宣布完成对Cursor的收购,但此前披露的600亿美元收购选项不能直接视为最终成交价。交易真正重要之处,在于SpaceX开始合并GPU算力、AI模型和开发者入口;能否产生价值,要看Cursor能否保持独立运营、多模型选择和产品开放性。

迪士尼教AI拆线稿,画师的笔还得自己拿
迪士尼研究院公布一套线稿矢量化方法,用深度和语义模型拆解笔画骨架,联合Bézier曲线与2D Gaussian Splatting做可微拟合,还试着扩展到视频跟踪。论文自称重建效果达到state-of-the-art,但没给具体指标和基线对比,视频结果也只是初步尝试。真正值得注意的是,拟合结果留了给画师改样条的接口——这说明团队清楚,全自动化这条路目前走不通。

一枚“火烈鸟”导弹,打穿了俄罗斯的火箭生产线
乌克兰用国产“火烈鸟”巡航导弹打击了俄罗斯萨马拉的TsSKB-Progress工厂——这家企业造的是俄罗斯85%以上发射任务依赖的Soyuz-2火箭,也包括给国际空间站补给的那一款。俄方称“局部损伤”,画面却是大火浓烟,损毁范围至今没有独立信源证实。

AI账号被盗怎么办?流传的自查指南漏了三个坑
TechCrunch给出了ChatGPT、Claude、Perplexity查看和登出可疑会话的操作步骤,但比对官方文档会发现:操作顺序、Perplexity的MFA说法都存疑,而无密码登录设计把安全防线转移到了用户的邮箱和Google账号上。

程序员觉得AI让自己快了20%,METR实测却是慢了19%
METR的一项对照实验发现,经验丰富的开发者用AI辅助编程,任务耗时反而增加19%,但他们事后依然认为自己快了20%。与此同时,OpenAI证实被广泛引用的SWE-bench Verified基准已被污染,厂商刷榜的分数并不可比。体感和榜单这两把常被拿来判断AI编程价值的尺子,眼下都不太可信。

302选16:斯坦福让AI设计的病毒基因组第一次真的能跑
斯坦福团队用基因组语言模型Evo 2生成302个噬菌体候选基因组,最终只有16个成为能感染实验室大肠杆菌的活病毒,成功率约5%。独立分析显示这些成品仍落在已知ΦX174家族的多样性范围内,更像系统性搜索演化没走过的组合,而非凭空造出新病毒。对噬菌体疗法研发者来说这值得跟踪,但离临床采购还差审批路径、动物实验和成本下降。

测蜱虫49.99美元,CDC却说别据此吃药
号称全球首款家用蜱虫莱姆病检测试剂盒LymeAlert原计划2025年8月上市,单份49.99美元起,但截至2026年8月官网仍标注仅限预订。更关键的是,它的核心卖点——测完就知道该不该吃抗生素——恰恰是CDC和IDSA明确不建议依据蜱虫检测结果做的事。

《阿索卡》第二季与《星际战斗机》亮相D23,但离正式定档还差一步
据 The Verge 报道,Lucasfilm 在 D23 展示了《阿索卡》第二季预告,并为瑞恩·高斯林主演的《星际战斗机》播放现场限定片段。真正需要分清的是:会场展示可以确认项目仍在推进,却不等于公开物料和档期已经完成官方落地。

Switched on Pop登陆Netflix,播客受众数字为何越说越糊涂
The Verge这篇号称聊主持人爱吃蔬菜、爱玩吉他效果器的生活趣味访谈,实际发布时间正好卡在Vox Media与Netflix达成播客视频独家协议之后一个月。这档做了12年、近500集的音乐播客今年7月才正式登陆Netflix,而官方宣称的“数千万”受众和第三方估算的十万到五十万月听众之间,隔着两个量级的差距。

“像带团队一样用AI”走红之后,出了错谁负责?
一篇个人博客提出,与AI协作更像领导团队而非操作代码,这一比喻在任务分解和迭代评审层面确实成立,但一旦涉及代码溯源和问责,就撞上了开发者社区正在真实经历的裂缝。斯坦福的研究和Hacker News的争论都指向同一个问题:流畅的“协作感”不等于可靠的责任链条。

Zig砍掉泛型I/O接口,编译时间账本却有赢有输
Zig用近两年时间彻底重构I/O接口,砍掉GenericWriter/AnyWriter,改用基于vtable的std.Io.Writer,代价是所有开发者必须手动管理缓冲区并显式调用flush。重构自带的基准显示,编译速度有的场景快了两成多,唯一的真实项目样本却慢了一成多,0.16规划的io_uring/kqueue后端也仍停留在概念验证阶段。

漫威披露新版《X战警》阵容:Adam Driver在列,2028档期仍有变数
漫威在D23活动上披露新版《X战警》首批阵容,影片暂定2028年5月5日上映。真正重要的不是某一位演员加盟,而是漫威终于开始为MCU版变种人团队搭建固定班底;不过片名、故事关系和制作进度仍不清楚,现阶段谈成败还太早。

编辑舍不得摘的磁吸指环支架,官方却让你充电前先摘掉
The Verge编辑称一款50美元的OhSnap磁吸指环支架“从没想过摘下来”,但同系列产品的官方说明却写着无线充电时建议先取下——这暴露了磁吸手机配件在“常戴体验”和无线充电兼容性之间的老矛盾。厂商给出的厚度、重量、磁力参数目前也缺乏独立测评验证,读者最好把“厂商自述”和“长期耐用”分开看。

Netflix新推荐系统:线上只涨0.006%,标注数据却少用了40倍
Netflix用大模型改造推荐系统,内部测试显示离线排序指标涨1.6%,线上核心指标只涨0.006%,但标注数据用量减少了40倍。这不是一次效果突破,更像一次刻意避开自回归生成陷阱的降本工程。