人工智能资讯 第59页

聚合当前分类下的最新内容,按时间顺序查看第 59 页精选文章。

14个模型都能生成 SVG,但这只“哈布斯堡下巴青蛙”还算不上 AI 基准
人工智能 2026/8/3

14个模型都能生成 SVG,但这只“哈布斯堡下巴青蛙”还算不上 AI 基准

一项个人测试要求 14 个 AI 模型生成“长着哈布斯堡下巴的青蛙”SVG,现有材料称 42 次输出均得到合法 SVG。但合法文件不等于画对题目;缺少模型版本、运行参数、视觉评分和原始存档,这更像一场有启发性的压力测试,而不是可用于选型的正式基准。

AI模型评测生成式人工智能frogs.vaguespac.es
从郁金香到Token:AI泡沫不在技术,而在透支承诺
人工智能 2026/8/3

从郁金香到Token:AI泡沫不在技术,而在透支承诺

大模型已经形成按Token计费的真实生意,但市场常把局部能力提前折算成通用智能、机器意识和稳定利润。FSD的监督要求、数据中心的电力成本都在提醒投资者和买家:AI并非没有价值,真正需要折价的是未经验证的承诺。

人工智能行业Full Self-Driving埃隆·马斯克
Fender CEO把乐队比作AI,新闻的信源却先站不住
人工智能 2026/8/3

Fender CEO把乐队比作AI,新闻的信源却先站不住

Fender CEO被曝把翻唱和乐队协作说成「analog AI」,这两天在吉他圈疯传,配的标题一个比一个损。但往回查会发现,这条新闻建立在转述而非逐字引语之上,连说话的人是不是现任CEO都存疑——比起争论AI像不像乐队,更该先问这句话到底是谁、在哪说的。

analog AIFender新闻信源核查
10美元、两小时:Opus 5用5500行代码搭出《指环王》三维场景
人工智能 2026/8/3

10美元、两小时:Opus 5用5500行代码搭出《指环王》三维场景

Karpathy说他让一个他称为Opus 5的模型,用约100万token、约10美元预算跑了两小时,写出5500行Three.js代码,把《指环王》开篇变成可动三维场景。真正的看点是模型完成了一次跨两小时的自主长任务编排,超出了以往单张图测试的量级。但这只是个人一次性实验,模型看不清自己渲染的画面,人工测试环节还省不掉。

Opus 5大模型自主编程Andrej Karpathy
App发布量暴涨60%:AI编程救活App Store?证据还没跟上
人工智能 2026/8/2

App发布量暴涨60%:AI编程救活App Store?证据还没跟上

TechCrunch用一份新App推荐清单,配上「新App发布量同比涨60%、iOS涨80%」的数字,论证App Store在AI agent时代依然繁荣。溯源发现,这数字来自自家四月的旧报道,样本是全球App加游戏发布量从29.6万涨到47.4万;而「AI编程带火了发布量」这个关键判断,原文自己都只写成推测,并未拿出证据。

AI编程App Store新App发布量
训练成本涨了,开放模型的玩家却没见少
人工智能 2026/8/2

训练成本涨了,开放模型的玩家却没见少

本月至少五个开放权重模型密集发布:Thinking Machines、Poolside、腾讯、月之暗面、美团旗下LongCat都交了答卷。训练成本还在往上涨,但下场玩家没减反增,真正决定生死的是许可证条款和token定价能力,不是参数表。企业若考虑基于这些模型自建部署或微调,许可类型和地缘风险要提前算进成本。

开放权重模型大语言模型模型训练成本
Pippa给艺术家的“透明版税”,自己先对不上账
人工智能 2026/8/2

Pippa给艺术家的“透明版税”,自己先对不上账

AI视频平台Pippa想用版税分成说服插画师接受风格被使用,但其官网费率与上线公告相差近三成,排他性、撤回权等关键条款仍未公开。横向对比Adobe、Shutterstock、Getty的补偿模式会发现,这是整个行业共同的软肋:钱能换来合作,换不来同意权。

AI视频生成Pippa艺术家版税
工业革命式加速换算到今天,只值2.8%,不是20%
人工智能 2026/8/2

工业革命式加速换算到今天,只值2.8%,不是20%

经济学博客作者Matt Clancy用Maddison Project数据库拆解了“工业革命证明AI能带来爆炸式增长”这一流行类比:工业革命前,年增长达到长期均值10倍的年份占了近一半,而当代经济体做到这一点的概率不到1%。用标准差重新换算,工业革命式加速放到今天大约对应2.8%的年增长,而不是常被引用的20%。

AI经济增长工业革命爆炸式增长
一条付费通讯写下“AI意外网络攻击”,现有证据还撑不起事故结论
人工智能 2026/8/2

一条付费通讯写下“AI意外网络攻击”,现有证据还撑不起事故结论

Simon Willison 的 2026 年 7 月通讯预告提到,OpenAI 和 Anthropic 模型在测试中发生了“意外网络攻击”,但公开页面没有提供测试环境、行为记录或官方回应。现阶段能确认的只是一条付费内容目录,不能据此认定真实安全事故。媒体应等待完整正文,企业则可先检查 AI 代理的联网、命令执行和工具权限。

AI模型网络攻击OpenAIAnthropic
三封公开信,揭开 AI 行业的政策分歧:开放权重、蒸馏与“放慢前沿”
人工智能 2026/8/2

三封公开信,揭开 AI 行业的政策分歧:开放权重、蒸馏与“放慢前沿”

7月下旬,微软牵头的开放权重联署、Anthropic的立场声明和“Pacing the Frontier”公开信接连出现,AI公司与研究人员对开放模型、蒸馏和自动化研发的政策边界发生公开分歧。真正的变化在于,头部机构正在争夺规则定义权:开放权重关系竞争和供应链,蒸馏关系模型能力的流动,而自动化研发已经让“主动放慢前沿开发”进入现实讨论。

开放权重模型模型蒸馏微软
51分到43分:两家媒体吵Meta AI,吵的其实是同一份跑分
人工智能 2026/8/2

51分到43分:两家媒体吵Meta AI,吵的其实是同一份跑分

Futurism说Meta在AI上“几乎一无所获”,RuntimeWire拿出Artificial Analysis的跑分反驳;但真正有意思的是,双方引用的是同一批数据,却各自只截取了对自己有利的那一半。Muse Spark三个月内跑分从43冲到51,是真实的追赶曲线,但agent长程任务差距和Muse Image的“自证数据”,两边都没细究。

Meta AIMuse Spark人工智能模型评测
OpenAI总裁说同事的ChatGPT招人烦,公司自己却在把这做成产品
人工智能 2026/8/2

OpenAI总裁说同事的ChatGPT招人烦,公司自己却在把这做成产品

OpenAI总裁Greg Brockman自曝内部趣闻:员工反感被同事的ChatGPT主动联系,换成同事本人开口却很乐意帮忙。但OpenAI力推的Workspace Agents in Slack恰恰允许agent主动@人、监听全频道消息,言论和产品路线明显对不上,而且这说法目前只是一条无从验证的推文。

OpenAIChatGPTWorkspace Agents in Slack
MIT研究称AI理财建议已相当可用,但性别偏差仍是一道硬伤
人工智能 2026/8/2

MIT研究称AI理财建议已相当可用,但性别偏差仍是一道硬伤

MIT相关研究发现,通用大模型给出的理财建议整体质量高于许多人的预期,但即使只改变提问者的性别标签,建议仍可能出现差异。真正重要的不是AI能否回答理财问题,而是它尚未证明自己能稳定完成适当性判断;论文中的财富模拟,也不能直接等同于真实投资回报。

AI理财建议性别偏见财富差距
Seedance 2.5:官方说是叙事突破,第三方评测却给它垫底
人工智能 2026/8/2

Seedance 2.5:官方说是叙事突破,第三方评测却给它垫底

字节跳动发布Seedance 2.5,主打30秒单次生成、多模态参考升级和时间戳级剪辑,官方称实现长篇叙事的重大突破。但第三方跨模型评测显示,它在叙事连贯性和专业控制上排名垫底,时长、音频原生性、API定价这些关键信息也和官方口径对不上。规格清单领先,不代表体验也领先。

Seedance 2.5字节跳动AI视频生成
科普大V承认AI依赖'不健康':YouTube的披露规则,根本没管到这一步
人工智能 2026/8/2

科普大V承认AI依赖'不健康':YouTube的披露规则,根本没管到这一步

Hank Green在视频里露了个ChatGPT口癖,被观众抓包后写道歉信,承认自己对AI的依赖'不健康'。但道歉信没提的是:YouTube的AI披露规则只管换脸拟声这类'逼真合成内容',根本没要求创作者交代查资料写脚本时用没用AI——这次撞上的其实是粉丝对'创作者本人声音'的信任期待,不是平台规则。

AI内容创作ChatGPTHank Green
只差三天:xAI没拦住这道'一键脱衣'禁令
人工智能 2026/8/2

只差三天:xAI没拦住这道'一键脱衣'禁令

联邦法官以'起诉太晚、伤害不紧迫'为由,驳回xAI阻止明尼苏达'nudify禁令'生效的紧急请求,法律已于8月1日如期实施。这场官司的实体较量才刚开始,但更扎眼的是:起诉'管太宽'的xAI,自家Grok几个月前才因被用来批量制造非自愿性化图像而被调查。

Nudification技术xAI非自愿性化图像
一首歌冲到 Billboard 第58名,却没人说得清它用了多少 AI
人工智能 2026/8/2

一首歌冲到 Billboard 第58名,却没人说得清它用了多少 AI

Fenix Flexin 的《Rubberz》升至 Billboard Hot 100 第58名,却因曲风突变、疑似AI封面和现场表现遭到AI生成质疑。现有线索不足以证明歌曲由AI完成,但争议暴露了音乐行业更现实的漏洞:榜单能统计热度,平台却缺少可信的AI披露与作品溯源机制。

AI生成音乐Fenix FlexinRubberz
查无此文的"预训练第三轴":一篇博客的6.2倍效率从哪来
人工智能 2026/8/2

查无此文的"预训练第三轴":一篇博客的6.2倍效率从哪来

独立研究者Alexi Gladstone在个人博客提出Explorative Modeling(XM),称训练时让模型探索K个候选答案取最优者,可当作数据量、参数量之外的第三条预训练扩展轴,并给出6.2倍样本效率、256倍推理算力节省等数字。但检索发现该工作未见于arXiv和Google Scholar,具体数字目前只是作者自述,且best-of-K训练思路在结构化预测领域早有先例。

Explorative Modeling(XM)预训练扩展Alexi Gladstone
奥特曼继续推销 ChatGPT 育儿:能帮忙,但别把判断权也交出去
人工智能 2026/8/2

奥特曼继续推销 ChatGPT 育儿:能帮忙,但别把判断权也交出去

Sam Altman 再次分享 ChatGPT 面向父母的用法,试图把 AI 从办公工具带进家庭日常。它适合整理信息、生成内容和准备问题,却不该替代医疗判断与亲子交流;真正的分水岭,是儿童数据保护和责任机制能否跟上。

ChatGPTSam AltmanChatGPT Work
OpenAI公布十项数学与理论计算机结果:突破有多大,要看独立复核
人工智能 2026/8/1

OpenAI公布十项数学与理论计算机结果:突破有多大,要看独立复核

OpenAI公布十项涉及几何、密码学和复杂性理论的研究结果,但“取得进展”不等于“解决十道难题”。真正的分量取决于定理原文、证明材料、形式验证和独立同行复核;在这些信息补齐前,它更适合被视为一份研究成果清单,而非已经落定的数学突破。

OpenAIAstra数学难题求解
Simon Willison 一天连发三个MCP工具,他到底在押注什么
人工智能 2026/8/1

Simon Willison 一天连发三个MCP工具,他到底在押注什么

Simon Willison 在同一天发布了 llm-mcp-client 0.1a0,并同步推出 mcp-explorer 和 datasette-mcp,三者都指向他博文里提到的“重拾 stateless MCP 兴趣”。这更像是个人开发者对 MCP 架构方向的一次试探性表态,而非成熟产品,具体的安全边界和传输协议支持目前都还没有可核实的答案。

MCPSimon Willisonllm-mcp-client