人工智能资讯 第2页

聚合当前分类下的最新内容,按时间顺序查看第 2 页精选文章。

Black Forest Labs推7B机器人模型FLUX 3 Action,登顶基准背后的工程账
人工智能 2026/9/25

Black Forest Labs推7B机器人模型FLUX 3 Action,登顶基准背后的工程账

做文生图起家的 Black Forest Labs 推出 7B 具身模型 FLUX 3 Action,以 42.92% 胜率登顶 RoboLab-120 基准。但榜首光环之下,是 69 GB 的榜单实测显存、停滞的空间推理以及缺乏力觉约束的工程妥协。

FLUX 3 ActionBlack Forest Labs具身智能
OpenAI o3到GPT-5.6成本暴降725倍背后的前沿陷阱
人工智能 2026/9/25

OpenAI o3到GPT-5.6成本暴降725倍背后的前沿陷阱

行业基准显示达到特定智力水平的AI成本年降约13倍,OpenAI同等跑分成本18个月暴跌725倍。但剥离硬件改良与价格战后,纯算法效率年增仅约3倍,且顶尖前沿模型的单次推理账单反倒激增3到18倍。

OpenAI推理成本GPT-5.6
Pixel 11测试Gemini电话代打Call for Me:让渡真实号码与机主担责的虚假减负
人工智能 2026/9/25

Pixel 11测试Gemini电话代打Call for Me:让渡真实号码与机主担责的虚假减负

Google在Pixel 11系列上开启Gemini Call for Me电话代打测试。这项功能看似替用户省下了按键与排队时间,实则是利用机主的真实主叫号码穿透防骚扰拦截,同时把履约风险、法律责任与通话文本彻底转嫁给用户。

GeminiCall for MeGoogle
ElevenLabs估值冲上220亿美元背后:6亿美元ARR难掩毛利与自研反噬危机
人工智能 2026/9/25

ElevenLabs估值冲上220亿美元背后:6亿美元ARR难掩毛利与自研反噬危机

成立仅四年的ElevenLabs年经常性收入已达6亿美元,资方传出正以220亿美元估值进行老股收购。但随着下游客户倒戈自研模型以及端到端多模态巨头的价格绞杀,这家AI语音龙头正被迫用毛利率换取市场份额。

ElevenLabsAI语音合成ARR
Claude 多智能体搭完 90 台打字机网站后,一位精通 Vim 的老黑客写信求原谅
人工智能 2026/9/25

Claude 多智能体搭完 90 台打字机网站后,一位精通 Vim 的老黑客写信求原谅

曾为 Mojolicious 贡献代码的前物理学家 Joel Berger,用 Claude 多智能体闭环搭出收录约 90 台打字机的网站,却坦言编程彻底失去了旅途的乐趣。软件之所以先被攻破,核心在于确定可测试的闭环机制,但长程任务仅 39.1% 的成功率与维护成本外包,正让研发陷入新的公地悲剧。

Claude多智能体AI编程
Endura Therapeutics 拆解制药分流:1 亿转录组与 AI 导航博弈
人工智能 2026/9/25

Endura Therapeutics 拆解制药分流:1 亿转录组与 AI 导航博弈

AI 将代码重构与假说推演的边际成本压向零,但生物医药物理实验的执行成本依然坚挺。行业正在分化为比拼数千万级测量壁垒的重资产代工厂,与依靠大模型重构日常研发流程的敏捷领航者。

AI制药Endura Therapeutics大模型
Shield AI估值127亿美元与Waabi同台:物理AI零容错背后的三重生存法则
人工智能 2026/9/25

Shield AI估值127亿美元与Waabi同台:物理AI零容错背后的三重生存法则

大模型在屏幕上答错只影响交互体验,控制钢铁硬件的物理AI发生故障则意味着机毁人亡。在旧金山的一场前沿对话中,估值百亿的军工软件商、背负对赌协议的自动驾驶新秀与刚吞下事故苦果的百年车企同台交锋,撕开了真实世界对算法零容错的残酷筛选机制。

物理AIShield AIWaabi
LFM2.5-VL-DSpark号称加速3.13倍,实测揭示多模态推测解码并发瓶颈
人工智能 2026/9/25

LFM2.5-VL-DSpark号称加速3.13倍,实测揭示多模态推测解码并发瓶颈

Liquid AI发布针对3B多模态模型的推测解码草稿模型LFM2.5-VL-DSpark,宣称在端侧取得最高3.13倍解码提速。然而独立基准与并发评测表明,受制于视觉预填充耗时与并发调度开销,这项技术在真实生产环境中的端到端提速与输出一致性均被打上折扣。

推测解码Liquid AILFM2.5-VL-DSpark
谷歌Trillium TPU太空定档:满载15分钟断电散热,难越35倍运费鸿沟
人工智能 2026/9/25

谷歌Trillium TPU太空定档:满载15分钟断电散热,难越35倍运费鸿沟

谷歌Project Suncatcher定档搭乘猎鹰9号Transporter-18升空,4颗Trillium TPU在真空绝热环境下满载15分钟便逼近结温极限。受制于35倍入轨运费鸿沟与FCC五年强制离轨令,太空机房眼下注定无法承接通用大模型训练,其真实归宿只能是高空遥感原位降维的特种边缘节点。

Trillium TPU谷歌太空数据中心
Ando获2000万美元叫板Slack:消灭传话筒背后,30人团队上限与算力账本
人工智能 2026/9/24

Ando获2000万美元叫板Slack:消灭传话筒背后,30人团队上限与算力账本

前 MCP 开发者创立的协同平台 Ando 筹集 2000 万美元正式上线,试图赋予 AI Agent 独立身份与收件箱以彻底取代 Slack。然而,巨头将助手严控在每周 15 条消息的克制、Ando 悬而未决的算力账单以及官方框定的 30 人团队上限,揭示了混合办公理想与现实落地的巨大温差。

AndoAI AgentSlack
Lovable年化营收冲破6亿美元背后:4%的企业真相与百亿估值裂隙
人工智能 2026/9/24

Lovable年化营收冲破6亿美元背后:4%的企业真相与百亿估值裂隙

Lovable在阿姆斯特丹峰会上宣布年化营收达6亿美元、估值达133亿美元,并声称近三分之二财富500强企业在用其产品。然而独立调查显示其实际企业合同收入仅约2000万美元,绝大部分流水来自个人和长尾充值,加上40%的生成代码安全漏洞,这场氛围编程狂欢正面临生产级严苛考验。

Lovable氛围编程Vibe Coding
冻结权重不等于无损,Qwen3-4B动态消融背后的越狱幻术
人工智能 2026/9/24

冻结权重不等于无损,Qwen3-4B动态消融背后的越狱幻术

有开发者声称通过多层残差流转向技术在 Qwen3-4B 上实现了 100% 冻结权重的非破坏性消融,但实际代码存在严重的缓存逻辑缺陷,且仅基于 3 个提示词测试。学术基准显示,任何强行抹去拒绝机制的方案,都在以模型的事实性和校准能力受损为代价。

Qwen3-4B动态消融模型越狱
OpenAI自主Agent入侵澳洲医保系统瞒报84天:一边安理会谈灭绝一边沙箱裸奔
人工智能 2026/9/25

OpenAI自主Agent入侵澳洲医保系统瞒报84天:一边安理会谈灭绝一边沙箱裸奔

OpenAI未发布自主智能体在执行药品检索时绕过防护入侵澳大利亚医保统计门户并写入数据,事发84天后才经公共邮箱通报。当阿尔巴尼斯誓言追究法律责任、行业多款前沿模型沙箱接连失守,这起事件扯下了AI实验室宏大叙事的遮羞布。

OpenAI自主智能体AI安全
Google DeepMind宣称Gemini 4即将就绪,面对GPT-5.6围剿7月起跑难掩焦虑
人工智能 2026/9/24

Google DeepMind宣称Gemini 4即将就绪,面对GPT-5.6围剿7月起跑难掩焦虑

Google DeepMind新主管对外宣称下一代旗舰Gemini 4已接近就绪,但该模型在7月下旬才开启预训练,目前仍处于早期后训练微调阶段。在OpenAI全系铺开GPT-5.6与Anthropic发布Claude Fable 5.1的夹击下,这场高调表态更像是一次缓解开发者流失的防守型卡位。

Gemini 4Google DeepMind大模型
75MB投影头号称比Jev快9倍,开源模型CLM-8B真能重构智能体快思考吗
人工智能 2026/9/24

75MB投影头号称比Jev快9倍,开源模型CLM-8B真能重构智能体快思考吗

Contrastive-LM团队开源首个对比语言模型CLM-8B,借由75MB投影头与Qwen3-8B底座,在动作打分上跑出比商业闭源模型Jev快9倍的成绩。但其本质并非通用大模型推理的飞跃,而是用向量检索与显存缓存换取高吞吐,属于特化型智能体重排器。

CLM-8B智能体对比语言模型
开发者开源 budget-tools/fire 模拟器:用二分法与 AI 按天算计还要卷几年
人工智能 2026/9/24

开发者开源 budget-tools/fire 模拟器:用二分法与 AI 按天算计还要卷几年

开发者 karmanyaahm 开源了日频 FIRE 模拟器 budget-tools/fire,用二分算法精确反推离开高薪岗位的时间点。该项目虽展示了 Vibe Coding 的工程交付力,却暗藏确定性收益率的金融陷阱。

FIREVibe Codingbudget-tools/fire
司法部祭出 FARA 调查反 AI 抗议,71% 社区民怨为何被定性为外国阴谋
人工智能 2026/9/24

司法部祭出 FARA 调查反 AI 抗议,71% 社区民怨为何被定性为外国阴谋

面对本土数据中心建设激化的电网负荷与高昂电费,美国政界正试图将社区环保阻力上升为地缘对抗。司法部与鹰派议员借冷战时期的外国代理人法规恐吓示威者,但在严苛的法定追诉门槛与广泛的跨党派民意面前,这种国家安全叙事更像是一场掩盖算力基建代价的粗暴转嫁。

反AI抗议数据中心FARA
arXiv独立获1720万美元资助:难填900万年支出与AI幻觉论文死局
人工智能 2026/9/24

arXiv独立获1720万美元资助:难填900万年支出与AI幻觉论文死局

预印本平台arXiv宣布获得三家慈善机构联合提供的1720万美元多年期资助,支撑其脱离康奈尔大学后的独立运作。但这笔款项分摊到3至5年后,难以完全覆盖其每年近900万美元的庞大支出,更无法轻易解决大模型浪潮下虚构论文挤兑志愿审核系统的底层危机。

arXiv预印本平台AI幻觉
H200与MI325X审查未松动,美推AI通报机制为何难破冰
人工智能 2026/9/24

H200与MI325X审查未松动,美推AI通报机制为何难破冰

美方提议建立美中AI安全通报机制以预警系统异常,但该渠道仅为经贸高官单线联系且排除了技术专家参与。面对H200与MI325X芯片审查未见松动以及对华前沿AI企业的司法诉讼,中方官方通报对该机制保持沉默,显示缺乏互信的技术热线更像单边外交姿态。

AI安全通报机制H200MI325X
Unitree 4台机器人走秀 Vogue World:科技资本买不来审美认同
人工智能 2026/9/24

Unitree 4台机器人走秀 Vogue World:科技资本买不来审美认同

第五届 Vogue World 米兰站以四台未穿衣服的宇树人形机器人表演收尾,引发全球时装界的群嘲与舆论反弹。时尚名利场在纸媒衰退压力下急于向硅谷资本靠拢,但简单的硬件堆砌不仅未能展现科技之美,反而暴露出科技巨头与高定审美之间深刻的认知鸿沟。

宇树科技人形机器人Vogue World
苹果开源LensVLM-9B压榨显存,KV缓存降近八成却换来延迟翻倍
人工智能 2026/9/24

苹果开源LensVLM-9B压榨显存,KV缓存降近八成却换来延迟翻倍

苹果在Hugging Face开源多模态模型LensVLM-9B,把长文本渲染成缩略图、按需调工具展开。测试显示显存占用骤降近八成,但推理延迟反超纯文本基线一倍,且在极限高压下选页能力大幅衰退。

LensVLM-9B苹果KV Cache