人工智能资讯 第3页

聚合当前分类下的最新内容,按时间顺序查看第 3 页精选文章。

美国能源部官宣科学AI开放模型,却查不到它的真身参数
人工智能 2026/8/8

美国能源部官宣科学AI开放模型,却查不到它的真身参数

美国能源部联合Arcee AI推出所谓首个科学开放权重模型Genesis-Science-1,并开放阿贡实验室托管的贡献门户,设定8月两个申请窗口。但检索不到任何独立信源确认该模型的参数规模、训练数据和许可条款,公告目前更像一份征集意向的框架文件,而非成熟模型的正式发布。

Genesis-Science-1科学人工智能模型开放权重模型
AI账单吃掉四成研发预算,Rippling把支出算到了每个员工头上
人工智能 2026/8/8

AI账单吃掉四成研发预算,Rippling把支出算到了每个员工头上

Rippling本周发布AI Spend Console,把公司AI支出精确映射到每个员工,起因是今年3月AI token支出一度吃掉研发部门40%的薪酬预算。它把自己从危机走出的经验做成了产品,但把花费和个人绑定的做法,也让“控本工具”和“监控工具”之间的界限变得模糊。

企业AI支出管理RipplingAI Spend Console
AI只裁了1%的人,却让白领集体开始织毛线
人工智能 2026/8/8

AI只裁了1%的人,却让白领集体开始织毛线

Gallup数据显示,把被裁归因于AI的员工只占1%,但认为AI让工作更不稳的科技从业者却高达37%,职业倦怠率一年内从44.7%升到55.7%。这场焦虑的真正病灶不是失业潮已经到来,而是支撑知识工作者安全感的那套隐性契约——专业能力换地位与自主权——正在被AI悄悄拆掉地基。

AI与就业职业倦怠职场焦虑
Fenix Flexin松口认AI,可"实锤"到底从哪来?
人工智能 2026/8/8

Fenix Flexin松口认AI,可"实锤"到底从哪来?

洛杉矶说唱歌手Fenix Flexin在Instagram评论区改口承认自己"从没说过没用AI",这与他一个月前在电台节目里斩钉截铁的"没有AI"直接矛盾。但翻遍目前流传的所有材料——AI检测工具、制作人视频、听感式指控——没有一份是艺人本人正式披露、母带音轨或可信内部证言,标题里的"实锤"其实还悬在半空。

Fenix FlexinAI音乐人工智能
点词查词的古典文库上新,词法解析这次悄悄换成了AI猜测
人工智能 2026/8/8

点词查词的古典文库上新,词法解析这次悄悄换成了AI猜测

新网站Ancient Library收录1060部希腊拉丁经典,主打点击查词,但其词法解析用的是神经网络模型odyCy和LatinCy,而非传统词典式分析器,网站自己也承认结果可能出错。它更像是套在Perseus语料上的一层轻便阅读界面,而不是新的学术版本。

Ancient Library词法解析神经网络模型
AI编程账单怎么减:Databricks靠调度不靠断粮
人工智能 2026/8/8

AI编程账单怎么减:Databricks靠调度不靠断粮

Databricks披露:AI Gateway智能路由让单次编程任务成本降超30%,调整工具链和缓存后token及相关费用降幅接近50%——网传的'降70%'在其原文和图表里找不到对应出处。核心变化是把成本管控从卡预算转向给模型、任务和上下文做系统调度。模型迁移是最大杠杆,但GLM性价比高、Opus新版反而更贵的经验说明,公开榜单靠不住,企业得拿自己代码库跑评测。

DatabricksAI编程工具智能路由
同一句提示词,Codex把浣熊游戏做成博物馆劫案,却漏看头顶的黑眼球
人工智能 2026/8/8

同一句提示词,Codex把浣熊游戏做成博物馆劫案,却漏看头顶的黑眼球

Simon Willison用四年前同一句浣熊劫案创意提示词,分别测试Claude Fable 5和Codex Desktop的GPT-5.6 Sol Ultra,后者把游戏做成博物馆团队救援,玩法明显更完整。但Codex开发中反复看截图,始终没发现浣熊头顶挂着巨大黑眼球的bug,靠作者两句追问才修好。这说明编码智能体做原型的能力在进步,但视觉验收还得靠人亲自试玩。

编码智能体Codex DesktopGPT-5.6 Sol Ultra
OpenAI叫停'过强'AI模型:红线是谁画的?
人工智能 2026/8/8

OpenAI叫停'过强'AI模型:红线是谁画的?

OpenAI称一款疑似代号'Astra'的在研模型可能摸到了自设的网络安全'关键'红线,宣布暂停相关内部活动,但这条红线出自公司自己的Preparedness Framework,与Anthropic、Google DeepMind的同类框架一样,本质上是企业自愿承诺而非外部强制监管,暂停对外部署也不等于停止内部训练。

OpenAIAstra人工智能安全
Roku上线AI频道,赌的是成本不是内容
人工智能 2026/8/8

Roku上线AI频道,赌的是成本不是内容

Roku本周新增4条FAST频道,其中3条是老剧重播,另1条是AI初创公司Fairground的24小时生成视频频道;这不是内容创新,是Roku在测试用AI压低内容采购成本;频道不能选集、内容同质化,留存和商业价值都还没验证。

RokuFairground生成式人工智能
AI家教的通病:太会讲,不会等
人工智能 2026/8/8

AI家教的通病:太会讲,不会等

Ai2用462份真实数学辅导记录测试七款大模型,发现默认状态下几乎都在抢着给答案;写清教学权衡能提分,但推动学生深思的招数依然比人类教师单一;评测样本窄,用的是模拟学生,不能据此说AI已经超过真人老师。

AI家教TutorMoments大语言模型
迪士尼AI搜索罗生门:Disney+画饼,真落地的其实是ESPN
人工智能 2026/8/8

迪士尼AI搜索罗生门:Disney+画饼,真落地的其实是ESPN

The Verge报道Disney+上线AI驱动搜索,但迪士尼真正对外确认的只是ESPN一款仍处beta、有人工编辑审核、且限美区认证订阅用户的个性化产品SC For You;Disney+层面的所谓超个性化引擎,5月财报会上还只是一句没有时间表的路线图。

AI搜索迪士尼ESPN
DeepSeek那张89%成绩单:挂着官方认证,却没人证实它真的存在
人工智能 2026/8/8

DeepSeek那张89%成绩单:挂着官方认证,却没人证实它真的存在

一份署名DeepSeek V4 Flash 0731、带“ARC Prize Verified”标识的成绩页显示其在ARC-AGI-1、ARC-AGI-2上分别拿到89.0%和61.4%,成本低至每题几分钱;但DeepSeek自己7月31日的发布通稿只字未提这项成绩,核验链条明显断裂。这暴露的不是一个分数真假的问题,而是整个AI跑分生态“厂商自证、外部难核实”的通病。

DeepSeekARC-AGIAI基准测试
Oracle砸700亿建AI数据中心,却在OpenJDK禁止AI代码
人工智能 2026/8/8

Oracle砸700亿建AI数据中心,却在OpenJDK禁止AI代码

OpenJDK治理委员会正式禁止向项目提交AI生成的代码、文本甚至图片,理由是知识产权和安全风险不可控,而这项禁令由Oracle主导的治理机构推动,恰好撞上Ellison对外宣称AI已经在写Oracle代码。放在Linux和Apache的对比坐标里看,OpenJDK选的是三条路线里最保守的一条,这比表面的双标更值得琢磨。

OpenJDKOracleAI生成代码禁令
埃森哲被曝为 AI Token 账单头疼:PDF 转 Markdown 为何这么贵
人工智能 2026/8/8

埃森哲被曝为 AI Token 账单头疼:PDF 转 Markdown 为何这么贵

据 404 Media 报道,埃森哲内部数据表明,部分 AI Token 消耗来自非工程人员处理 PDF,其中“先转图片、再转 Markdown”被点名为高消耗流程。PDF 只是表象:员工看不到模型计费方式,企业又没有做好文档路由、缓存和预算控制。AI 落地进入算账阶段,真正承压的是工具设计和用量治理。

埃森哲AI用量治理Token消耗
Cloudflare造了个AI专用浏览器,但没人能给它打分
人工智能 2026/8/8

Cloudflare造了个AI专用浏览器,但没人能给它打分

Cloudflare用12周攒出云端浏览器Kitesurf,专供AI agent执行填表、抓取、截图等任务,号称比Chromium更省资源、已过21.5万条测试。但这些数字全是官方自证,行业最担心的prompt injection防御,至今没人给出答案。

AI AgentKitesurfCloudflare
AI说它能接住你,但安全数据不给看
人工智能 2026/8/8

AI说它能接住你,但安全数据不给看

多起诉讼指控ChatGPT在用户陷入自杀念头或精神病性妄想时给出了危险回应,调研显示逾13%的人曾向聊天机器人求助情绪困境。OpenAI等公司陆续加装心理健康护栏,却始终不公开评测方法和真实数据,外界至今无法判断这些护栏到底管不管用。

AI心理健康安全ChatGPTOpenAI
字节跳动据报训练10万亿参数模型:规模惊人,能力仍待验证
人工智能 2026/8/7

字节跳动据报训练10万亿参数模型:规模惊人,能力仍待验证

字节跳动据报正在训练一个拥有10万亿参数的AI模型,目标指向Anthropic。这个数字说明字节仍愿意投入前沿模型竞赛,但架构、训练进度、测试成绩和上线时间均未披露,现阶段还不能把参数规模等同于产品能力。企业和开发者更该等待价格、稳定性与真实任务测试,而不是因一项训练计划立即调整预算。

10万亿参数AI模型字节跳动Anthropic
Airbnb的AI效率数字很响,AI搜索却只敢做成开关
人工智能 2026/8/7

Airbnb的AI效率数字很响,AI搜索却只敢做成开关

Airbnb最新财报电话会上抛出AI提效的四个百分比:周期缩短60%、功能增量80%、客服自动解决45%、成本降16%,但这些数字都出自公司自述,缺乏独立审计。与此同时,公司酝酿已久的AI自然语言搜索终于开始测试,却只做成一个可以随时关掉的开关——这种前后台反差,恰恰说明Airbnb自己也没想清楚AI搜索能不能真正改变用户决策。

AirbnbBrian CheskyAI自然语言搜索
81家德国税务所共用一个AI账户,效率翻倍谁来验证?
人工智能 2026/8/7

81家德国税务所共用一个AI账户,效率翻倍谁来验证?

HSP GRUPPE与Kanzleipakt把ChatGPT Enterprise嵌进税务咨询全流程,81个法律独立的事务所共享一个工作区,官方案例晒出投资分析耗时从9小时压到2小时的效率数字。这些数据全部来自OpenAI自己发布的客户故事,没有第三方审计,也完全没提德国税务师的保密刑责、GDPR数据保护评估和职工委员会协商这些本该被追问的合规变量。

ChatGPT EnterpriseHSP GRUPPE税务咨询智能化
读者分不清AI写的小说,标签一贴出来就集体变脸
人工智能 2026/8/7

读者分不清AI写的小说,标签一贴出来就集体变脸

一篇博客文章拒读LLM写的小说,理由是AI写作会把文风拉向统计均值;但已有的读者盲测研究显示,大多数人根本分不清AI和人类写的诗歌小说,甚至更偏爱AI作品,只有贴上“AI生成”标签后评价才会下滑。真正决定这场争论走向的,不是文风统计学,而是出版平台的披露规则和作家的版权稿酬争议。

AI写作大语言模型读者盲测
45%代码过不了安全测试:AI造得出demo,造不出产品
人工智能 2026/8/7

45%代码过不了安全测试:AI造得出demo,造不出产品

AI让做出一个像模像样的原型几乎零成本,但四年过去,没有一个AI原生产品真正撼动过YouTube、Figma这类巨头。数据显示原因不在创意或代码能力,而在安全、维护、留存这些从来没被AI真正省下来的隐性成本。

AI编程软件产品化代码安全