Claude Code 過去一個月變笨:Anthropic 4 月 23 日 postmortem 拆出三條獨立 bug,從思考強度被降到一行 prompt 砍能力,三條全修,並重置所有訂閱者 usage limits。
⭐ 文章深度讀:直接給你 Anthropic 自承的三層 QA 盲區清單
→ https://heymaibao.com/claude-code-april-23-postmortem/
⚡ 章節重點
Claude Code 為什麼變笨 00:00
第一條:預設思考強度被偷偷降級 01:53
第二條:每回合都清思考的 cache bug 02:55
第三條:一行 system prompt 砍掉 3% 分數 03:54
為什麼多重 review 與 dogfooding 都漏掉 04:49
Anthropic 用 Opus 4.7 反過來抓自家 bug 06:11
給 agent / coding tool 開發者的通用教訓 06:43
📝 懶人包
∙ 過去一個月 Claude Code 變笨是真的,原因是三條完全獨立的工程改動:預設思考強度從 `high` 被降到 `medium`、一個讓 Claude 越聊越失憶的 cache bug、一行為了壓回應長度而上線的 system prompt 反而砍能力。三條問題分別命中 Sonnet 4.6、Opus 4.6 與最新的 Opus 4.7。
∙ 三條都已在 4 月 20 日的 Claude Code v2.1.116 之前修好。 Anthropic 從 4 月 23 日對所有訂閱者重置 usage limits 作為補償。
∙ 「usage limits 縮水更快」其實是上面那個 cache bug 連續快取沒命中的副作用,不是 Anthropic 獨立的計費動作。
∙ 我的觀察:這份 postmortem 真正值得帶走的,不是這三條 bug 各自被修好,而是 Anthropic 親自寫出來的三層 QA 盲區。跨系統交界的 corner case 過了多層 review、員工用的內部 build 跟對外 ship 的 build 不一致、一行壓回應長度的 system prompt 沒跑夠逐行測試就上線。對任何在做 agent / coding tool 的人都是通用警告。
📚 參考資料
Anthropic - An update on recent Claude Code quality reports
→ https://www.anthropic.com/engineering/april-23-postmortem
@ClaudeDevs 在 X 上的對應發文
→ https://x.com/claudedevs/status/2047371123185287223