概述
Superpowers v6.4.1(2026-09-19 發布;v6.4.0 從未實際出貨,v6.4.1 是這批變更的第一個 release)把火力放在三件事:讓執行計畫有便宜的新選擇(Native execution)、讓出問題的 session 可以被事後診斷(diagnosing-superpowers),以及再擴大三個平台(OpenCode 2.0、Muse、Qwen Code)。
原本預定同版推出的 proving-it-works-with-a-movie skill 因尚在清理與強化而保留到之後的版本。
executing-plans:從 stub 到 Native 執行模式
這是本版最重要的行為改變,先講背景。
舊版只是個 64 行的 stub
v6.4.1 之前的 executing-plans 是一個 64 行的 stub,實測效果與「完全沒裝 plugin」相同。它名義上提供 inline(原生)執行,實際上沒有做任何事。
重建後的 Native 執行
v6.4.1 把它重建為真正的執行模式(#2318):
- 同一套規則:session 在與 subagent-driven development(子代理驅動開發)相同的 workspace、ledger 與 stopping rules 下,自己實作每一個任務。
- 最後一次總審查:全部任務完成後,派發一個全新的 whole-branch review 給最強的模型。
- Ledger 誠實助手:
task-start與task-done兩個 helpers 確保 ledger(帳本)與 test log 如實記錄。
這是執行計畫最便宜的方式,而且在中階 session model 上就能跑得很好。
行為改變:不再中途停下來
注意:executing-plans 不再每幾個任務停下來與你確認。它跑完整個計畫,最後做一次 review。
計畫 handoff 現在會提供兩種方式——Subagent-driven 與 Native——說明各自成本,並依計畫內容推薦其一(附理由)。如果你已經選了,它尊重你的選擇(#2258、#2318)。
怎麼選?
| 面向 | Native(inline) | Subagent-driven |
|---|---|---|
| 互動成本 | 低(跑完一次 review) | 高(controller 全程監督) |
| 隔離成本 | 低(共用 session context) | 高(每任務獨立 context) |
| 適合 | 中小型、任務同質性高的計畫 | 高風險、需要逐一驗證的計畫 |
| 模型需求 | 中階 session model 即可 | controller + implementer + reviewer |
新 Skill:diagnosing-superpowers
當一個 session 出問題——重複做同樣的工作、計畫被無視、某個 skill 沒有觸發、帳單金額異常——過去你只能憑印象猜原因。
v6.4.1 新增的 diagnosing-superpowers(#2236、#2287)讓你直接對 agent 說:
「figure out what went wrong with superpowers in this session」
它會:
- 與你一起把問題 pin down(先釐清症狀,不是立刻下結論)
- 讀磁碟上的 transcripts(session 逐字記錄)
- 回報發現,而且每個發現都附
path:line證據 - 視要求建立 scrubbed bundle(去除敏感內容的封存包)或草擬 GitHub issue——都先給你核准,引用證據原樣保留
支援診斷當前 session 或過去的 session。
這個 skill 的設計哲學值得注意:它不靠 agent 的「記憶」或自我感受回答,而是回到磁碟上的原始記錄找證據。session 時間一長,模型對「剛剛發生了什麼」的敘述並不可靠;transcript 才是 ground truth(事實來源)。
Writing Plans:先看計畫再跑
兩個配套改動(#2258):
- 你會先審查已儲存的計畫:核准一個想法或一個範圍,不再等同於核准一份你還沒看過的計畫。任何東西開始執行前,計畫本身會先呈現給你。
- 計畫攜帶 Review Focus section:最多五個輸入或 failure mode,讓最後的 whole-branch review 知道該重點看哪裡。
三個新 Harness
| Harness | 備註 |
|---|---|
| OpenCode 2.0 | OpenCode 大版本更新後的支援 |
| Muse | 新平台整合 |
| Qwen Code | Qwen 的 coding CLI |
對既有使用者的影響
- 習慣
executing-plans中途暫停確認的人:流程改為「跑完再一次 review」。若某個計畫需要頻繁人工介入,改選 subagent-driven。 - 想找出「上次那個 session 為什麼卡住/燒錢」的人:直接試
diagnosing-superpowers,它會給你帶行號的證據。
學習重點
- Native vs Subagent-driven 是教科書級的取捨:inline 執行省下 subagent dispatch 的開銷(context 重建、角色引導、啟動成本),代價是所有任務共用同一個 session context——任務之間會互相「看見」。隔離與成本不可兼得,明白自己在買哪一邊就好。
- 自省(introspection)要靠外部記錄:diagnosing-superpowers 示範了「讓 agent 讀自己的 transcripts 找根因」——自我診斷的證據基礎是外部持久化的記錄,不是模型對自身的內省。
來源:v6.4.1