Anthropic 攤開內部數據:超過 80% 程式碼由 Claude 寫、工程師產出 8 倍於 2024,卻同時說願意可驗證地暫停前沿 AI。一篇拆解遞迴自我改進真相、taste 暗線與對齊風險。
⭐ 文章深度讀:Anthropic 接下來幾個月要辦的 RSI 政策對話會生出什麼具體共識
→ https://heymaibao.com/anthropic-recursive-self-improvement/
⚡ 章節重點
開場 00:00
80% 的程式碼是 AI 寫的 00:26
AI 一年內進化有多快 01:25
數字會騙人,方向沒騙人 02:14
什麼是遞迴自我改進 03:04
taste 是人類最後的護城河 04:15
模型開始訓練模型的恐怖 05:37
為什麼這家公司想暫停 06:32
我們該怎麼辦 07:21
📝 懶人包
∙ Anthropic 攤開內部數據:超過 80% 的程式碼由 Claude 撰寫 (Claude Code 2025 年 2 月上線前還是個位數),2026 年第二季每位工程師每天合併的程式碼量,是 2024 年的 8 倍。
∙ 真正的轉變不是「AI 變強」,而是人類角色在開發鏈的每一步收窄。寫碼、跑實驗這些「做」的事趨近免費,瓶頸從「做」轉移到「判斷哪件事值得做」。
∙ Anthropic 罕見表態:如果能可驗證地讓多國前沿實驗室同步暫停,它願意暫停或放慢,而這番話,是在它聲勢最高的時候說出口的。
∙ 我的觀察:這篇文章的數字會騙人,但方向沒騙人。8x 是被自己承認高估的虛榮指標,可是「人類角色收窄、taste 變成最後護城河、模型開始訓練模型」這三件事是真的,後面這條對齊暗線才是我會睡不著的地方。
📚 參考資料
Recursive self-improvement (Marina Favaro and Jack Clark, 2026)
→ https://www.anthropic.com/institute/recursive-self-improvement
YouTube:對 Anthropic 遞迴自我改進文章的 reaction 影片
→ https://youtu.be/xjucOlb_mFM