好观点2026-04-29 12:00

一边宣布 5GW 一边复盘三个 bug——Anthropic 这一周说了两件相反的事

导读

把 Anthropic 4 月 24 日这两条稿放一起读,看到的是产业级的精神分裂:

Anthropic 在 4 月 24 日同时挂了两份稿——一份是和亚马逊扩到 5 GW 算力的合作公告,一份是承认 Claude Code 三个月以来质量不对劲、定位出三个独立 bug 的 postmortem。两份稿放在一起,写出了这家公司也这个产业的核心张力:扩张的速度 vs. 已发出去的产品的可靠性。

Anthropic Claude Code postmortem cover image
图注:Anthropic 4 月 23 日 Claude Code 质量复盘头图。来源:[Anthropic](https://www.anthropic.com/engineering/april-23-postmortem)。

第一条Anthropic and Amazon expand collaboration for up to 5 gigawatts of new compute。Amazon 再追投 250 亿美元,换 Anthropic 未来 10 年在 AWS 上累计 1000 亿美元的算力承诺,包括约 5 GW 的新增容量。

第二条An update on recent Claude Code quality reports。Anthropic 承认过去一个月用户反映的"Claude Code 比以前差"是真的——他们追溯到三处独立的 bug:

  • 3 月 4 日起:Claude Code 默认 reasoning effort 从 high 偷偷降到了 medium
  • 3 月 26 日起:一个缓存 bug 让 thinking 内容被反复清空(应该只清空一次)
  • 4 月 16 日起:一条 system prompt 指令开始限制模型的 verbosity

三处都是配置/工程层面的小改动——不是模型本身退化,但用户感受到的就是模型退化

> "All three issues have now been resolved as of April 20 (v2.1.116)."

也就是说,从 3 月初到 4 月 20 日的近 7 周里,已付费的 Claude Code 用户拿到的是一个被悄悄削减能力的产品,没人通知过他们。

这两条之间不只是巧合

把这两条放一起最让人不安的,不是任何一条本身——而是它们出现在同一周。

5 GW 是产业级的扩张承诺:硬件采购、电力规划、数据中心施工、跨 10 年的财务模型。这种事得整个公司聚焦才能拍下来。同时段里,已经发出去的产品里悄悄出现了三个独立 bug、累积影响 7 周、靠用户反映才被发现——这件事说明的是注意力没有给到 maintenance

不是"Anthropic 不在乎质量"——他们的 postmortem 写得相当透明,三个 bug 都给出了具体修复 commit。而是这家公司——以及更广义地说,所有 frontier lab——的注意力分配规则已经倾斜到一个程度:新的 GW、新的 model size、新的 RL run 是 P0;已发出去的产品默默退化 是要等用户喊出来才发现的 P3。

为什么这一定会发生

这条机制其实不只是 Anthropic 的问题。Frontier lab 的工程优先级只能是这样:

  1. 下一代模型预训练(赌的是公司未来 5 年)
  2. RL 后训练 + safety 对齐(决定模型能不能上线)
  3. infrastructure scaling(决定第 1+2 步能不能跑得起来)
  4. ……
  5. 已上线产品的 maintenance(什么时候出问题什么时候修)

这是创业公司的组织规律——产品工程团队 vs 研究团队,产品工程总是要挪资源支持研究。Anthropic 已经做得比平均好——transparency hub + 7 周内自己发现 + 主动 postmortem——但机制层面的不对称依然存在

OpenAI 上一周有 GPT-5.5 涨价 2 倍 + 三天的 sign-up 故障;Google DeepMind 一周内发了 7 件大事但没有任何 maintenance 复盘。这不是 Anthropic 一家公司的张力,是整个 frontier 阶段的产业张力。

一个不太好听的判断

我们应该承认这件事:

对 Anthropic / OpenAI / DeepMind 这一档的实验室来说,"已上线产品的可靠性"将持续是 P3 优先级——直到外部世界(监管、企业客户合规、行业标准)把它强制升到 P1。

理由很简单:这些公司的核心 thesis 是"下一代模型创造的价值比这一代任何 maintenance 价值都大"。这个 thesis 不一定错,但它的副作用是:在通往下一代的路上,这一代正在悄悄退化

5 GW 算力会让下一代模型更强;但如果 7 周里没人盯 v2.1,这 5 GW 同时也保证了下一代模型上线后大概率走同样的曲线——发出去、悄悄退化、用户喊出来、修。

这一周 Anthropic 做了一件好的事是把这件事说出来了。下一步的衡量标准是:会不会有结构性的资源调整——比如把 maintenance budget 显式从研究投入里抠出来?或者引入"模型上线后 N 周仍维持发布时基准"这种合同级的 SLA?

不会有。短期内不会。这是这个产业现阶段的真相。

把互动收束在正文之后

第一版正式上线会把点赞、收藏和评论放在正文之后,保留杂志式留白,同时让登录用户能留下真实反馈。

互动

评论区

评论会在审核通过后公开显示。

0/500· ⌘/Ctrl + Enter 提交

当前环境尚未配置 Supabase,互动功能暂时不可用。

想参与互动?前往登录

  • 还没有公开评论 — 欢迎成为第一位留言的人。累计历史互动 0,新评论将从这里重新开始。

相关阅读