AMD跑GLM 5.2跑赢英伟达,但真正在赢的不是AMD
Wafer 在 AMD MI355X 上跑通 GLM 5.2:单节点聚合吞吐达 B200 的 80%,成本只有一半。表面是 AMD 越来越能打,深层是英伟达护城河正从三个方向同时被侵蚀。
Wafer 在 AMD MI355X 上跑通 GLM 5.2:单节点聚合吞吐达 B200 的 80%,成本只有一半。表面是 AMD 越来越能打,深层是英伟达护城河正从三个方向同时被侵蚀。
Anthropic 论文声称读懂 Claude 的"潜意识":模型内部自发长出两套系统——"自动化处理器"(说流利话)与"工作台"(真推理),可独立运作。用输出推断模型"想什么"的底层假设可能错了。
Karpathy 用 9 万 Star 项目验证:同一模型、同一任务、同一评测器,只换五种 Harness,得分在 3.5%-80.1% 间剧烈波动。Agent 最大误区——76 分差距与模型无关,瓶颈在 Harness。
Hugging Face 冻结模型权重(不微调不训练),只改外层执行代码:同一模型得分从 3.5% 跳到 80.1%。Karpathy 700 次实验揭示 Harness 第一定律——Agent 最大瓶颈不在模型里。
ICML 2026 杰出论文(清华黄高团队+阿里):扩散语言模型理论上解空间更大,但数学推理与代码生成反而更差。更灵活的结构反而限制推理——"灵活性陷阱"挑战"自由=更聪明"假设。
Vercel 的 npx skills add 发布五个月 2.4 万星、支持 68+ 工具——AI 编程工具正经历"npm 时刻":能力包成为新分发单位。但 npm 踩过的坑(依赖地狱、质量参差)一个没少。
Fable 5 解禁背后的第三次跃迁:不是 AI 取代程序员,是程序员被"升职"——从"写代码的人"变成"验收 AI 工作的人",从自己动手变成 @ 一下 Claude 等收 PR。组织方式被重写。
Cloudflare 9 月 15 日起默认屏蔽混合用途 AI 爬虫:逻辑从"默认允许"翻转为"默认屏蔽"。不是保护创作者——是互联网收费站从搜索引擎搬到基础设施层,坐收费亭的还是同一类人。
Codex 周活 500 万,知识工作者采用速度是开发者的 3 倍以上。一个编码工具非开发者用得更多——AI 产品价值单位正从"创造代码的能力"迁移到"操作计算机的能力"。
Fable 5 解禁 + Claude Tag 接入 Slack:Cherny 说"我每天就是看 PR 一个个提上来"。团队 65% 代码已由 Tag 生成——当写代码成为过去时,工程师的下一站是"验收员"。