人工智能资讯 第12页

聚合当前分类下的最新内容,按时间顺序查看第 12 页精选文章。

7款模型、1008次运行:未发现“鹈鹕骑车”专项优化证据
人工智能 2026/7/23

7款模型、1008次运行:未发现“鹈鹕骑车”专项优化证据

Dylan Castillo用48组提示词交叉测试7款模型,每组运行3次,未发现“鹈鹕骑自行车”存在显著的专项优势。实验不能证明所有实验室从未针对公开基准训练,但它说明,单张亮眼样图不足以支持模型记忆、数据污染或厂商“刷题”的指控。

大模型评测图像生成鹈鹕骑自行车
一本绝版传记,为什么能被AI排进非虚构书单前十
人工智能 2026/7/23

一本绝版传记,为什么能被AI排进非虚构书单前十

一位科技博主用AI工具把英语世界约6500本非虚构奖项入围/获奖作品整理成免费索引,能搜索、排序,还能语义找相似书。AI在这里没写一个字,只负责整理和检索,却让绝版好书重新排到前面。真正该担心的不是AI替人写书,而是好书写出来后没人看得见。

Book Prize Index语义搜索Claude Code
美国把制裁摆上桌,Kimi K3 的“蒸馏”指控还缺什么证据
人工智能 2026/7/23

美国把制裁摆上桌,Kimi K3 的“蒸馏”指控还缺什么证据

美国财长贝森特称,若月之暗面被证实大规模蒸馏 Anthropic 的 Fable,或规避芯片出口管制开发 Kimi K3,制裁与实体清单措施都可能成为选项。蒸馏本身是常见训练方法,争议要落到访问记录、数据来源、许可条款和芯片流向。Kimi K3 真正碰到的,是美国闭源模型用高投入维持高定价的商业叙事,但竞争焦虑不能替代证据。

月之暗面Kimi K3Anthropic
OpenAI晒出新闻业AI成绩单:案例扎实,账本空白
人工智能 2026/7/23

OpenAI晒出新闻业AI成绩单:案例扎实,账本空白

OpenAI集中放出美联社、Axios、BILD等媒体的AI应用案例,范围从核验、检索扩展到广告销售和读者产品。这些案例证明AI正被嵌入部分新闻机构的核心流程,但错误率、部署成本、收入增量全部缺席,效果说法只有厂商和合作方自己讲。

新闻业AI应用OpenAI生成式人工智能
1008张SVG未发现“鹈鹕特训”,基准污染仍不能排除
人工智能 2026/7/23

1008张SVG未发现“鹈鹕特训”,基准污染仍不能排除

一项实验让7个前沿模型生成1008张SVG,没有发现“鹈鹕骑自行车”被明显定向优化:鹈鹕只排8种动物中的第6,自行车和目标组合也未显著占优。但每组仅3个样本,评分又依赖模型裁判,这项实验只能降低作弊嫌疑,无法替公开基准洗清污染风险。

AI模型评测SVG生成鹈鹕骑自行车
分词提速989倍:GigaToken该信多少,该等什么
人工智能 2026/7/23

分词提速989倍:GigaToken该信多少,该等什么

GigaToken把CPU分词吞吐做到24.53GB/s,常见BPE分词器比HuggingFace Tokenizers快989到1268倍,靠SIMD重写、预分词缓存和绕开Python开销拿下这个数量级。SentencePiece只有7到22倍提升,WordPiece还不支持,这是项目方自测数据,不是独立复现的基准。分词吞吐涨了不等于训练流水线整体提速,瓶颈可能早就转移到了存储、清洗或GPU利用率上。

GigaToken分词器大语言模型
一段 ChatGPT 对话说自己'凑出'了雅可比猜想反例,却漏了最关键一步
人工智能 2026/7/23

一段 ChatGPT 对话说自己'凑出'了雅可比猜想反例,却漏了最关键一步

一段流传的ChatGPT对话构造出雅可比行列式恒为-2的三元多项式映射,声称是雅可比猜想的反例。但对话只证明了它和'原反例'线性等价,始终没证明这个映射不可逆——这恰恰是反例成立的决定性一步。

ChatGPT雅可比猜想反例验证
OpenAI预算涨到7500亿,佐治亚州3.2吉瓦电从哪来还没说清
人工智能 2026/7/23

OpenAI预算涨到7500亿,佐治亚州3.2吉瓦电从哪来还没说清

OpenAI把2030年前的基建预算上调到7500亿美元,比年初估算高约25%,首个落地项目是佐治亚州耗资200亿、需要3.2吉瓦电力的Project Camellia。电从哪来至今没有披露,而当地新增电网产能大头是天然气。AI竞赛的门槛正在从模型能力挪向电力和审批速度。

OpenAIAI基础设施Project Camellia
晒完四件全靠代工的'作品',他转身手写177行代码才敢署名
人工智能 2026/7/23

晒完四件全靠代工的'作品',他转身手写177行代码才敢署名

资深程序员Beej晒出的四件'作品'全靠代工——三件AI生成,一件雇人搭建;真正让他骄傲、愿意署名的,是后来手写的177行、比Claude慢约50倍的闪卡代码。这场对比戳中AI编程里一个常被忽略的问题:效率提升,换不换得来创作者的参与感和署名底气。

AI生成内容人类创作与AI代劳Claude
美国讨论封禁中国开放模型,Arcee反对:安全审计不该看国籍
人工智能 2026/7/23

美国讨论封禁中国开放模型,Arcee反对:安全审计不该看国籍

特朗普政府仅被曝讨论封禁中国开放权重模型,尚未采取行动。美国开放模型公司 Arcee 认为,企业本地部署后,模型厂商没有天然的远程访问通道,风险应交给代码审查、供应链隔离和上线测试处理。争议背后还有一笔更现实的账:Kimi K3、Qwen 等低成本模型正在压缩美国大型闭源模型的利润空间,安全判断必须和商业防卫分开算。

开源权重模型本地部署AI模型封禁争议
Substack不封杀AI写作,只让你自证清白
人工智能 2026/7/23

Substack不封杀AI写作,只让你自证清白

Substack接入AI写作检测工具Pangram,为应用内超过100字符的帖子、Notes、回复和评论提供人机写作比例估算,但不禁止也不处罚AI辅助写作,作者可申诉误判、可选择公开创作流程。这是一次用可见性换信任的赌注,短期可能让不少内容账号露出马脚,长期成败取决于检测误差能不能被关进笼子里。

AI写作检测SubstackPangram
2000名研究者、400万美元Codex额度,OpenAI要把AI嵌进美国国家实验室
人工智能 2026/7/23

2000名研究者、400万美元Codex额度,OpenAI要把AI嵌进美国国家实验室

OpenAI加入能源部Genesis Mission,向约2000名国家实验室和高校研究者提供400万美元Codex额度,两项科研行动获300万美元API支持,外加最高1000万美元配比额度。重点方向是高温超导材料和"机器可及前沿地图",但两项行动目前都还没有可验证的科学成果。额度换来的是准入,不是发现——科学产出最终要看实验室里的验证,不是账户里的余额。

OpenAICodexGenesis Mission
陆军喊话AI随便用,一个多月后自己先限流了
人工智能 2026/7/23

陆军喊话AI随便用,一个多月后自己先限流了

美国陆军5月宣布AI token不限量,6月中旬额度就见底,只能紧急恢复限额,10月后续不续供官方没说法。真正的问题不是员工用得猛,是推广时没人算清成本、效果和责任这三笔账。Meta、Uber也走过同样的路:先喊敞开用,再悄悄设上限。

美国陆军Ask SageAI token额度
一位工程师借39年前的拒绝电脑宣言,给AI创作划了条线
人工智能 2026/7/23

一位工程师借39年前的拒绝电脑宣言,给AI创作划了条线

一名软件工程师撰文重提温德尔·贝里1987年拒绝购买电脑的宣言,借此反思生成式AI对写作和艺术的侵蚀,却认为AI编码大多只是效率工具。他的核心判断是:该讨论的不是AI能不能生成,而是效率收益能不能抵消创作痕迹流失和审查成本上升。

生成式AIAI创作AI编码
开源模型落后几个月?这问题本身就问错了
人工智能 2026/7/23

开源模型落后几个月?这问题本身就问错了

Kimi K3上周四发布时权重还没放出,同一个周末Qwen宣布下一代旗舰走开放权重路线,官方也在世界人工智能大会上把开源列为技术方向之一。围绕这几件事,网上又在争论开源模型到底落后闭源几个月,但真正决定差距的,其实是资本效率、后训练能力和部署基础设施谁先跑通,不是某个跑分数字。

开源大模型开放权重Kimi K3
Google给美国17家国家实验室追加4000万美元AI额度,不是现金
人工智能 2026/7/22

Google给美国17家国家实验室追加4000万美元AI额度,不是现金

Google DeepMind向美国能源部“创世纪任务”追加4000万美元AI调用额度和云服务抵扣,覆盖17家国家实验室,形式是一年期工具访问权,不是现金拨款。官方案例显示显微镜校准提速八倍,但数据只来自Google自家博客,尚未经同行评审。对国家实验室人员是即时可用的资源,对其他科研机构和政府采购方,这笔“友情价”不能直接套进预算规划。

Google DeepMind美国能源部创世纪任务国家实验室
OpenAI 上线 Presence:电话客服75%不用人工,企业智能体却还得靠驻场工程师
人工智能 2026/7/22

OpenAI 上线 Presence:电话客服75%不用人工,企业智能体却还得靠驻场工程师

OpenAI 推出面向企业的语音与聊天智能体平台 Presence,靠护栏、模拟评测和人工升级把智能体真正送进生产环境,其自家电话客服上线后已能自动解决75%来电,10天内又把转人工比例压低15个百分点。但这款产品仍以有限开放、非自助方式提供,部署依赖OpenAI驻场工程师和指定系统集成商,说明企业智能体规模化落地远没有想象中简单。

OpenAIPresence企业智能体
Comet、Dia、Neon争抢任务入口,AI浏览器还没撼动Chrome
人工智能 2026/7/22

Comet、Dia、Neon争抢任务入口,AI浏览器还没撼动Chrome

2026年的浏览器竞争开始转向AI代理:Comet、Dia和Neon试图跨网页读取信息、调用账户并执行任务。产品数量增加不代表Chrome和Safari的优势已经松动,真正的门槛是执行可靠性、数据权限与用户信任能否同时成立。普通用户暂时不必急着迁移,工作账户较多的用户则应先查清授权、留痕和数据政策。

AI浏览器浏览器竞争OpenAI
350万美元赌一件事:AI能不能替建筑公司猜中谁会中标
人工智能 2026/7/22

350万美元赌一件事:AI能不能替建筑公司猜中谁会中标

AI建筑获客平台Cascade完成350万美元种子轮融资,靠聚合分散招标数据、用历史标书预测项目与潜在中标方切入市场。这门生意的真正门槛不是信息聚合,而是能不能靠客户反馈把预测越训越准,目前还只是个起步阶段的假设。

CascadeAI建筑获客招标预测
菜单被AI换了脸,10美元的家常味却还在
人工智能 2026/7/22

菜单被AI换了脸,10美元的家常味却还在

一家菲律宾/夏威夷小餐馆把菜单图换成AI生成图,菜品失真到让人食欲全无。实物一份10美元的spamsilog却朴素扎实,像家里的早餐。省设计费不是问题,把菜单这个点餐判断界面做丑,才是真正买单的地方。

AI生成菜单图生成式人工智能图像生成
Meta又造了一套AI水印,内容认证却可能更乱了
人工智能 2026/7/22

Meta又造了一套AI水印,内容认证却可能更乱了

Meta推出Content Seal,为自家新模型生成的图像嵌入隐形水印,并宣称能抵抗裁剪、压缩、缩放和截图。技术方向并不新,Google SynthID已走在前面,C2PA也提供了另一套来源凭证体系;真正需要审视的,是各平台自建认证系统后,用户能否跨平台验证,以及谁掌握检测入口。

AI水印Content SealMeta