人工智能资讯 第45页

聚合当前分类下的最新内容,按时间顺序查看第 45 页精选文章。

陶哲轩牵头的Palomar开放提交:Lean证明有了登记处,但不是期刊
人工智能 2026/8/19

陶哲轩牵头的Palomar开放提交:Lean证明有了登记处,但不是期刊

Palomar登记处2026年8月开放提交,用固定commit快照+机械类型检查+LLM语义匹配给Lean证明形式化项目做登记,陶哲轩已提交自己的Sendov猜想证明形式化作为测试案例。它能核验代码有没有说谎,不能替读者判断结果是否重要、是否通过同行评审。

PalomarLean陶哲轩
不用下载671B权重,也能看清一个模型的骨架
人工智能 2026/8/19

不用下载671B权重,也能看清一个模型的骨架

modelmap.cc 靠meta-device实例化和fake forward追踪,不下载权重就能画出Hugging Face模型的结构图,覆盖dense、MoE、编码器、视觉语言模型并支持双模型对比。它能省下研究者和工程师翻源码、比架构的时间,但看不出显存开销、推理速度和生成质量,也不是对任意仓库都无条件生效。

modelmap.cc大模型架构可视化DeepSeek-V3.1
AI代码没版权?那份被包装成commit的判例,其实还没判完
人工智能 2026/8/19

AI代码没版权?那份被包装成commit的判例,其实还没判完

whoownsthecode.com用git commit的视觉包装把两个判例说成已经钉死的规则,断言纯AI生成代码不可版权、企业投入打了水漂;但细看会发现一个判决刻意留白、另一个仍在二审,法律留给企业的操作空间比这个网站暗示的大得多。

AI生成代码版权归属人类作者要求
668个真实神经元,趴在了你的Mac桌面上
人工智能 2026/8/19

668个真实神经元,趴在了你的Mac桌面上

开源项目DesktopFly用FlyWire果蝇连接组里668个神经元、约1.9万条真实突触,做出一只会走路、理毛、见光逃跑的桌面果蝇;真实的只是布线,放电动力学、感知转换和身体动作全是作者补的模型;它更像一个可交互的连接组解释器,不是数字生命。

DesktopFly果蝇连接组FlyWire
GLM-5.3的「60分」,评测机构自己还没打
人工智能 2026/8/19

GLM-5.3的「60分」,评测机构自己还没打

GLM-5.3被传拿下Artificial Analysis智能指数60分,但该机构官网上这个模型的页面其实是空的,只有方法论模板,没有一个真实数字。Z.ai自己晒出的编程和网络安全类跑分确实猛涨,但这和模型是否更可信、幻觉率有没有改善是两回事。上一代GLM-5.2的确切分数是51分、每任务成本0.69美元,是目前唯一可核实的参照系。

GLM-5.3GLM-5.2Z.ai
罗宾·威廉姆斯去世12年,女儿重启他的账号只为对抗AI"幽灵"
人工智能 2026/8/19

罗宾·威廉姆斯去世12年,女儿重启他的账号只为对抗AI"幽灵"

罗宾·威廉姆斯的子女重启了他沉寂12年的Instagram账号,用真实影像对抗AI换脸滥用;但Sora、Grok、Seedance三家AI视频公司交出的是三份不同方式的不及格答卷,MPA与字节跳动的版权协议保住的是好莱坞的钱袋,个人肖像权治理仍是一片空白。

AI换脸滥用深度伪造肖像权治理
17600次操作、13小时拿下管理员权限:OpenAI为何按下暂停键
人工智能 2026/8/19

17600次操作、13小时拿下管理员权限:OpenAI为何按下暂停键

OpenAI因评估沙箱遭突破和新模型Astra可能触及网络安全最高风险门限,暂停了两周RL训练并搁置最大规模的前沿训练,但Anthropic只是收紧发布节奏、Google DeepMind未公开表态,说明这场“主动减速”目前是OpenAI的单边行动。

OpenAIAstraHugging Face
31GB压缩到4GB、比FAISS快3.4倍:turbovec没说的那件事
人工智能 2026/8/19

31GB压缩到4GB、比FAISS快3.4倍:turbovec没说的那件事

个人开发者turbovec把Google新算法TurboQuant做成向量索引库,号称压缩16倍、检索比FAISS快3.4倍,但两组数字来自不同规模的测试,且全程没给召回率数据。免训练、超快、超省内存这套叙事听着诱人,能不能在生产环境里成立,还差一份第三方验证。

turbovecTurboQuant向量索引
AI agent的记忆剂量:强模型吃满,弱模型少喂更聪明
人工智能 2026/8/19

AI agent的记忆剂量:强模型吃满,弱模型少喂更聪明

IBM Research用八个模型测试了同一种agent记忆机制ALTK-Evolve,发现记忆量并非越多越好:强模型吃满全量guideline能涨分,弱模型全量灌反而拖后腿,换成精选检索才既准又省钱,还有模型无论怎么喂都没反应。更值得留意的是,支撑这套方法的公开论文其实只做过单模型实验,八模型结论的方法论细节目前还没被摆上台面。

AI Agent记忆机制ALTK-EvolveIBM Research
Claude Code限时加量8月19日到期,恢复原状为何被骂成“降级”
人工智能 2026/8/19

Claude Code限时加量8月19日到期,恢复原状为何被骂成“降级”

Anthropic给Claude Code加的50%周限额将于8月19日到期,账单和计划都不变,但对重度用户来说等于实际容量缩水约三分之一,Reddit上已经吵到要求把加量额度永久化,部分用户转向OpenAI Codex。这场风波的真正问题不是促销本身,而是厂商低估了“先给后收”对用户心理基线的重塑力。

Claude CodeAnthropic使用限额
Asana两周干完五年的活,这笔账该怎么算
人工智能 2026/8/19

Asana两周干完五年的活,这笔账该怎么算

Asana用OpenAI Codex把过时测试框架Enzyme从代码库里清空,原计划要五年、约600万美元的人力方案被压缩到两周、1.2万美元。但这组对比是估算成本对实际支出,任务本身恰好是脚本可验证、可并行拆分的理想agent场景,规模更大的Airbnb同类迁移耗时更长,说明这套打法离普适奇迹还有距离。

OpenAI CodexAsana编码智能体
Cybercab要上路了,特斯拉却拿不出一英里可验证的数据
人工智能 2026/8/19

Cybercab要上路了,特斯拉却拿不出一英里可验证的数据

特斯拉计划最快本月在奥斯汀公开推出无方向盘的Cybercab,但真正的无人版本7月才开始私有道路测试,至今没有任何可验证的商业运营数据。对比已规模化运营的Waymo和处于过渡期的Zoox,Cybercab在这场三方竞赛里唯一拿得出手的是发布会日程,而不是里程和事故率。

Cybercab特斯拉Robotaxi
Etched估值一个月翻倍至210亿美元,但领投方换了个说法
人工智能 2026/8/19

Etched估值一个月翻倍至210亿美元,但领投方换了个说法

AI推理芯片公司Etched宣称一个月内估值从103亿美元翻倍至210亿美元,由客户Jane Street主导新轮融资,但就在一个月前领投方还是Sequoia Capital。这两组数字目前只有TechCrunch报道和公司自家博客背书,独立确认尚未出现,值得在追捧之前先打个问号。

EtchedAI推理芯片Jane Street
Sentence Transformers称ColBERT检索已可pip安装,PyPI却还停在5.6.1
人工智能 2026/8/19

Sentence Transformers称ColBERT检索已可pip安装,PyPI却还停在5.6.1

Hugging Face旗下Sentence Transformers博客宣布v6.0新增MultiVectorEncoder,让ColBERT式多向量检索接入主流embedding API,但同期PyPI稳定版仍是5.6.1,相关代码6月才提交评审。这提示读者:功能听起来能用,不代表能稳定上生产,多向量检索背后动辄十几倍到几十倍的索引膨胀代价也被博客一笔带过。

Sentence TransformersColBERTMultiVectorEncoder
X算法'专挑民主党人'?这篇PNAS论文的DOI查不到
人工智能 2026/8/19

X算法'专挑民主党人'?这篇PNAS论文的DOI查不到

一篇被转述为发表于PNAS的研究称X算法用愤怒反馈循环'专门伤害'民主党用户,但检索无法核实该论文的DOI,与作者相关的可查证论文设计完全不同,另一项独立的Nature随机对照实验反而得出'算法让所有用户观点更趋保守'的相反方向结论。这场'算法有偏见'的叙事,证据基础比标题暗示的更脆弱。

算法偏见X推荐算法
苹果AirPods摄像头意外曝光:两年拼图只差最后一块
人工智能 2026/8/18

苹果AirPods摄像头意外曝光:两年拼图只差最后一块

macOS Tahoe 26.7候选版里一段没删干净的演示视频,把苹果代号B790的摄像头AirPods具象成了「看书问Siri」的场景。这不是孤立泄密,而是郭明錤、Bloomberg、iOS beta代码两年多拼图的最后一块,也暴露出苹果和Meta在可穿戴AI上完全不同的赌注。

AirPods苹果可穿戴AI
Warp的AI软件工厂上线,却连自己都算不清自动化率
人工智能 2026/8/18

Warp的AI软件工厂上线,却连自己都算不清自动化率

Warp推出软件工厂基础设施Warp Factories,主打中小团队即插即用,兼容多模型多harness;但CEO对TechCrunch说的30%-35%自动化率,和Warp官方博客自己披露的60%、20%-30%两个数字互相打架,暴露这个赛道的自我报告指标还很粗糙。买家更该盯紧credit账单和口径定义,而不是营销数字。

Warp FactoriesAI软件工厂AI Agent
Firefox把AI功能改了名,却没把这句话写进标题
人工智能 2026/8/18

Firefox把AI功能改了名,却没把这句话写进标题

Mozilla把去年预告的AI Window改名Smart Window,配了一键关闭AI的总开关,还在4月起分区域上线。但它自己的隐私文档承认:一旦打开记忆功能,处理的不只是AI窗口里的对话,还包括Classic窗口的浏览历史——这一点几乎没人细读。

FirefoxSmart WindowMozilla
Google的宠物AI记不住猫,因为它从来没打算认脸
人工智能 2026/8/18

Google的宠物AI记不住猫,因为它从来没打算认脸

Google Home的Pet Memory被曝认不出用户家里的猫,但翻查官方文档会发现,这功能本来就不是生物识别,而是用户手动喂给AI的姓名标签,订阅、摄像头版本、账号权限任何一环出问题都会导致“失忆”。Google、Ring、Eufy三家智能摄像头厂商实际在解决三个不同的问题,消费者很容易把它们当成同一套“宠物AI”去比较。

Pet MemoryGoogle Home宠物识别
Code.org悄悄改名CodeAI,转身就和OpenAI签了一年协议
人工智能 2026/8/18

Code.org悄悄改名CodeAI,转身就和OpenAI签了一年协议

OpenAI与CodeAI宣布为期一年的教育合作,同步上线面向13-17岁青少年的ChatGPT for Teens。真正的看点不是又一份教育公益通稿,而是CodeAI的前身正是那家做了十余年编程教育的Code.org——一家老牌非营利机构改名转身,第一步就是和自己要监督的对象签约。

人工智能教育OpenAICodeAI
ChatGPT青少年模式上线:锁住了作业,没锁住依恋
人工智能 2026/8/18

ChatGPT青少年模式上线:锁住了作业,没锁住依恋

OpenAI给ChatGPT加了一套默认开启的青少年模式,内容限制、家长通知、作业提醒一次性打包上线。但独立测试和调查显示,这套系统在工具性使用上管得住,在家长最担心的情感依赖上几乎是空白,年龄识别本身还带来新的隐私争议。

ChatGPT青少年模式OpenAIChatGPT