2026-08-17
AI正在故意变笨:用世界知识换推理能力,这笔买卖划算吗
当一个模型AIME考了99.2分,却回答不出”法国首都是哪里”,你不应该觉得它蠢,而应该意识到:它从来没打算记住这件事。
READ MORE →
探索技术、AI与未来的个人博客
当一个模型AIME考了99.2分,却回答不出”法国首都是哪里”,你不应该觉得它蠢,而应该意识到:它从来没打算记住这件事。
把AI的”智能”拆开来看,你会得到一个不太舒服的结论:它最厉害的也许不是推理能力,而是能同时记住多少东西。
我们以为AI在增强认知能力,其实更像是认知版的免费Wi-Fi——大家都连,最后谁也上不去。
AI每周都在刷新”能干什么”的记录,我们却越来越难说清”它到底是怎么干出来的”。这中间的落差,可能才是2026年最该认真对待的事。
SAP暂停了大部分差旅和招聘。理由不是营收下滑,而是AI的账单正在失控。
当Anthropic、OpenAI、Google三家公司同时宣布”已修复”的时候,比漏洞本身更值得琢磨的是——加密推理链这个概念,从一开始就不应该让普通用户产生安全感。
当一台机器能拦住89%的危险操作,而审批权限的人类却放过了三分之一的威胁,我们到底该信任谁?
Claude Opus 4.7花了14个小时独立重写了16000行Go代码,账单251美元。看到这个结果,我第一反应不是”程序员完了”,而是:等等,这到底说明了什么?
当一个开源模型在”AGI圣杯”测试中杀出重围,比它得了多少分更值得关注的问题是:我们用来衡量智能的标尺,是不是正在失效?
404 Media曝光埃森哲内部录音:非技术员工正在疯狂消耗AI token。GitHub开始按token计费,Uber限制员工使用Claude Code。当热情退潮,企业终于开始算账了。