人工智能资讯 第20页

聚合当前分类下的最新内容,按时间顺序查看第 20 页精选文章。

硅谷读错了科幻——普利策历史学家点名马斯克
人工智能 2026/8/9

硅谷读错了科幻——普利策历史学家点名马斯克

哈佛历史学家Jill Lepore在新书《The Rise and Fall of the Artificial State》中提出,私营科技公司正在悄悄接管国家职能,她称之为“人造国家”。她的核心判断是:这不是技术决定的宿命,而是一连串可追溯的制度选择,因此也可以被拆解。

人造国家Jill Lepore算法治理
那段疯传的'AI接管预言',其实是一场氯胺酮隔离舱幻觉
人工智能 2026/8/9

那段疯传的'AI接管预言',其实是一场氯胺酮隔离舱幻觉

网站Kibotronics重发了神经科学家John C. Lilly 1978年描述'固态实体接管地球'的文字,被不少人当作AI风险的早期预言转发。但版本考据显示,这段文字最初定位是'小说化自传','形而上学自传'的标签是十年后再版时才贴上去的营销措辞,原文也完全隐去了它诞生于隔离舱注射氯胺酮状态下的关键背景。

AI接管预言人工智能风险John C. Lilly
Claude写的网站,复现了一个已修复的bug
人工智能 2026/8/9

Claude写的网站,复现了一个已修复的bug

独立开发者Terry Godier用Claude一次性生成了天文观测网站Dark Hours,一天后被原开源项目DarkHours.app作者Miguel Beher指出撞脸,关键证据是他的版本复现了对方早已修复的一个定位bug。Godier一小时内道歉、重定向域名、放弃iOS版,但AI是如何'看到'一个已经消失的bug,至今没有答案。

ClaudeAI生成网站Dark Hours
43%美国教师用AI检测器判作业,报告定不了作弊
人工智能 2026/8/9

43%美国教师用AI检测器判作业,报告定不了作弊

美国43%的六至十二年级教师已在用AI检测器判断学生作业是否由机器写成,但这类工具靠模型猜测而非数据库比对,判断依据通常不公开。传统查重能逐句展示重合内容,AI检测做不到,却越来越多被当成处分依据。真正的风险不是工具本身,而是学校把一个概率信号,当成了能定性的证据。

AI写作检测学术诚信GPTZero
从9阶纪录到任意 n>3 阶:AI辅助找到幻方六边形构造,证明仍待复核
人工智能 2026/8/9

从9阶纪录到任意 n>3 阶:AI辅助找到幻方六边形构造,证明仍待复核

开发者 Sergey Gukov 称,他借助 GPT-5.6 Sol 和自定义求解器,为任意 n>3 阶异常反对称连续幻方六边形找到了构造方法,并公开代码与候选证明。真正有分量的进展是把计算搜索收束为一般构造,但证明尚未经过 Lean 形式化或独立复核,目前不能当作已确认的数学定理。

AI辅助数学研究异常反对称幻方六边形GPT-5.6 Sol
编码提速55.8%还是变慢19%:两份AI效率研究互相打脸
人工智能 2026/8/9

编码提速55.8%还是变慢19%:两份AI效率研究互相打脸

一篇博文反驳"代码不是难点"的流行说法,但这场辩论其实可追溯到Fred Brooks 1986年的《没有银弹》。更值得关注的是两份实证研究的正面冲突:GitHub Copilot在绿地任务中提速55.8%,METR却发现资深开发者维护成熟代码库时反而慢19%,AI没让难点消失,只是把它挪了地方。

AI编程效率GitHub CopilotAI辅助编程
丹麦高中生要当面答辩作业:一场被包装成'新规'的试验
人工智能 2026/8/9

丹麦高中生要当面答辩作业:一场被包装成'新规'的试验

丹麦教育部宣布,约9000名HF高中生的书面作业将新增口头答辩环节,并配合屏幕监控和防火墙应对AI作弊。但对照原始信源会发现,这更像聚焦大型作业的一场试验,而非通稿描述的全面强制新规,监控技术本身也存在绕过和合规风险。

AI作弊口头答辩丹麦教育部
DeepMind开源飓风模型:多赢一天预警,答不出的是快速增强
人工智能 2026/8/8

DeepMind开源飓风模型:多赢一天预警,答不出的是快速增强

DeepMind开源的WeatherNext飓风模型用更低分辨率数据把预警提前了约一天,在飓风Melissa上首次让美国国家飓风中心提前五天预判五级强度。但气象界真正的考题是能否稳定捕捉'快速增强',这个模型至今没有给出确定答案。

WeatherNextDeepMindAI气象预测
提问量跌98.5%:一份报告想证明AI正在“杀死”六个网站
人工智能 2026/8/8

提问量跌98.5%:一份报告想证明AI正在“杀死”六个网站

创业公司HarperFlow发布《死亡互联网报告》,称Stack Overflow月度新增提问量较ChatGPT发布前暴跌98.5%,并把Chegg、Shutterstock、Fiverr、Quora、Getty的下滑一并归因于AI。但报告混用提问数、股价和维基百科浏览量三种口径,六合一的因果结论并不成立,真正能确认的只是部分需求正在被AI截走。

生成式AIStack OverflowChatGPT
美国能源部官宣科学AI开放模型,却查不到它的真身参数
人工智能 2026/8/8

美国能源部官宣科学AI开放模型,却查不到它的真身参数

美国能源部联合Arcee AI推出所谓首个科学开放权重模型Genesis-Science-1,并开放阿贡实验室托管的贡献门户,设定8月两个申请窗口。但检索不到任何独立信源确认该模型的参数规模、训练数据和许可条款,公告目前更像一份征集意向的框架文件,而非成熟模型的正式发布。

Genesis-Science-1科学人工智能模型开放权重模型
AI账单吃掉四成研发预算,Rippling把支出算到了每个员工头上
人工智能 2026/8/8

AI账单吃掉四成研发预算,Rippling把支出算到了每个员工头上

Rippling本周发布AI Spend Console,把公司AI支出精确映射到每个员工,起因是今年3月AI token支出一度吃掉研发部门40%的薪酬预算。它把自己从危机走出的经验做成了产品,但把花费和个人绑定的做法,也让“控本工具”和“监控工具”之间的界限变得模糊。

企业AI支出管理RipplingAI Spend Console
AI只裁了1%的人,却让白领集体开始织毛线
人工智能 2026/8/8

AI只裁了1%的人,却让白领集体开始织毛线

Gallup数据显示,把被裁归因于AI的员工只占1%,但认为AI让工作更不稳的科技从业者却高达37%,职业倦怠率一年内从44.7%升到55.7%。这场焦虑的真正病灶不是失业潮已经到来,而是支撑知识工作者安全感的那套隐性契约——专业能力换地位与自主权——正在被AI悄悄拆掉地基。

AI与就业职业倦怠职场焦虑
Fenix Flexin松口认AI,可"实锤"到底从哪来?
人工智能 2026/8/8

Fenix Flexin松口认AI,可"实锤"到底从哪来?

洛杉矶说唱歌手Fenix Flexin在Instagram评论区改口承认自己"从没说过没用AI",这与他一个月前在电台节目里斩钉截铁的"没有AI"直接矛盾。但翻遍目前流传的所有材料——AI检测工具、制作人视频、听感式指控——没有一份是艺人本人正式披露、母带音轨或可信内部证言,标题里的"实锤"其实还悬在半空。

Fenix FlexinAI音乐人工智能
点词查词的古典文库上新,词法解析这次悄悄换成了AI猜测
人工智能 2026/8/8

点词查词的古典文库上新,词法解析这次悄悄换成了AI猜测

新网站Ancient Library收录1060部希腊拉丁经典,主打点击查词,但其词法解析用的是神经网络模型odyCy和LatinCy,而非传统词典式分析器,网站自己也承认结果可能出错。它更像是套在Perseus语料上的一层轻便阅读界面,而不是新的学术版本。

Ancient Library词法解析神经网络模型
AI编程账单怎么减:Databricks靠调度不靠断粮
人工智能 2026/8/8

AI编程账单怎么减:Databricks靠调度不靠断粮

Databricks披露:AI Gateway智能路由让单次编程任务成本降超30%,调整工具链和缓存后token及相关费用降幅接近50%——网传的'降70%'在其原文和图表里找不到对应出处。核心变化是把成本管控从卡预算转向给模型、任务和上下文做系统调度。模型迁移是最大杠杆,但GLM性价比高、Opus新版反而更贵的经验说明,公开榜单靠不住,企业得拿自己代码库跑评测。

DatabricksAI编程工具智能路由
同一句提示词,Codex把浣熊游戏做成博物馆劫案,却漏看头顶的黑眼球
人工智能 2026/8/8

同一句提示词,Codex把浣熊游戏做成博物馆劫案,却漏看头顶的黑眼球

Simon Willison用四年前同一句浣熊劫案创意提示词,分别测试Claude Fable 5和Codex Desktop的GPT-5.6 Sol Ultra,后者把游戏做成博物馆团队救援,玩法明显更完整。但Codex开发中反复看截图,始终没发现浣熊头顶挂着巨大黑眼球的bug,靠作者两句追问才修好。这说明编码智能体做原型的能力在进步,但视觉验收还得靠人亲自试玩。

编码智能体Codex DesktopGPT-5.6 Sol Ultra
OpenAI叫停'过强'AI模型:红线是谁画的?
人工智能 2026/8/8

OpenAI叫停'过强'AI模型:红线是谁画的?

OpenAI称一款疑似代号'Astra'的在研模型可能摸到了自设的网络安全'关键'红线,宣布暂停相关内部活动,但这条红线出自公司自己的Preparedness Framework,与Anthropic、Google DeepMind的同类框架一样,本质上是企业自愿承诺而非外部强制监管,暂停对外部署也不等于停止内部训练。

OpenAIAstra人工智能安全
Roku上线AI频道,赌的是成本不是内容
人工智能 2026/8/8

Roku上线AI频道,赌的是成本不是内容

Roku本周新增4条FAST频道,其中3条是老剧重播,另1条是AI初创公司Fairground的24小时生成视频频道;这不是内容创新,是Roku在测试用AI压低内容采购成本;频道不能选集、内容同质化,留存和商业价值都还没验证。

RokuFairground生成式人工智能
AI家教的通病:太会讲,不会等
人工智能 2026/8/8

AI家教的通病:太会讲,不会等

Ai2用462份真实数学辅导记录测试七款大模型,发现默认状态下几乎都在抢着给答案;写清教学权衡能提分,但推动学生深思的招数依然比人类教师单一;评测样本窄,用的是模拟学生,不能据此说AI已经超过真人老师。

AI家教TutorMoments大语言模型
迪士尼AI搜索罗生门:Disney+画饼,真落地的其实是ESPN
人工智能 2026/8/8

迪士尼AI搜索罗生门:Disney+画饼,真落地的其实是ESPN

The Verge报道Disney+上线AI驱动搜索,但迪士尼真正对外确认的只是ESPN一款仍处beta、有人工编辑审核、且限美区认证订阅用户的个性化产品SC For You;Disney+层面的所谓超个性化引擎,5月财报会上还只是一句没有时间表的路线图。

AI搜索迪士尼ESPN
DeepSeek那张89%成绩单:挂着官方认证,却没人证实它真的存在
人工智能 2026/8/8

DeepSeek那张89%成绩单:挂着官方认证,却没人证实它真的存在

一份署名DeepSeek V4 Flash 0731、带“ARC Prize Verified”标识的成绩页显示其在ARC-AGI-1、ARC-AGI-2上分别拿到89.0%和61.4%,成本低至每题几分钱;但DeepSeek自己7月31日的发布通稿只字未提这项成绩,核验链条明显断裂。这暴露的不是一个分数真假的问题,而是整个AI跑分生态“厂商自证、外部难核实”的通病。

DeepSeekARC-AGIAI基准测试