Theme / v6.4.2

Superpowers

AI 開發方法論

基礎觀念

v6.4.1:Native 執行、自我診斷與三個新 Harness

掌握 v6.4.1 的重點變更:executing-plans 重建為 Native inline 執行、diagnosing-superpowers 自我診斷 skill,以及 OpenCode 2.0、Muse、Qwen Code 三個新 Harness。

概述

Superpowers v6.4.1(2026-09-19 發布;v6.4.0 從未實際出貨,v6.4.1 是這批變更的第一個 release)把火力放在三件事:讓執行計畫有便宜的新選擇(Native execution)、讓出問題的 session 可以被事後診斷(diagnosing-superpowers),以及再擴大三個平台(OpenCode 2.0、Muse、Qwen Code)。

原本預定同版推出的 proving-it-works-with-a-movie skill 因尚在清理與強化而保留到之後的版本。

executing-plans:從 stub 到 Native 執行模式

這是本版最重要的行為改變,先講背景。

舊版只是個 64 行的 stub

v6.4.1 之前的 executing-plans 是一個 64 行的 stub,實測效果與「完全沒裝 plugin」相同。它名義上提供 inline(原生)執行,實際上沒有做任何事。

重建後的 Native 執行

v6.4.1 把它重建為真正的執行模式(#2318):

  • 同一套規則:session 在與 subagent-driven development(子代理驅動開發)相同的 workspace、ledger 與 stopping rules 下,自己實作每一個任務。
  • 最後一次總審查:全部任務完成後,派發一個全新的 whole-branch review 給最強的模型。
  • Ledger 誠實助手:task-start 與 task-done 兩個 helpers 確保 ledger(帳本)與 test log 如實記錄。

這是執行計畫最便宜的方式,而且在中階 session model 上就能跑得很好。

行為改變:不再中途停下來

注意:executing-plans 不再每幾個任務停下來與你確認。它跑完整個計畫,最後做一次 review。

計畫 handoff 現在會提供兩種方式——Subagent-driven 與 Native——說明各自成本,並依計畫內容推薦其一(附理由)。如果你已經選了,它尊重你的選擇(#2258、#2318)。

怎麼選?

面向 Native(inline) Subagent-driven
互動成本 低(跑完一次 review) 高(controller 全程監督)
隔離成本 低(共用 session context) 高(每任務獨立 context)
適合 中小型、任務同質性高的計畫 高風險、需要逐一驗證的計畫
模型需求 中階 session model 即可 controller + implementer + reviewer

新 Skill:diagnosing-superpowers

當一個 session 出問題——重複做同樣的工作、計畫被無視、某個 skill 沒有觸發、帳單金額異常——過去你只能憑印象猜原因。

v6.4.1 新增的 diagnosing-superpowers(#2236、#2287)讓你直接對 agent 說:

「figure out what went wrong with superpowers in this session」

它會:

  1. 與你一起把問題 pin down(先釐清症狀,不是立刻下結論)
  2. 讀磁碟上的 transcripts(session 逐字記錄)
  3. 回報發現,而且每個發現都附 path:line 證據
  4. 視要求建立 scrubbed bundle(去除敏感內容的封存包)或草擬 GitHub issue——都先給你核准,引用證據原樣保留

支援診斷當前 session 或過去的 session。

這個 skill 的設計哲學值得注意:它不靠 agent 的「記憶」或自我感受回答,而是回到磁碟上的原始記錄找證據。session 時間一長,模型對「剛剛發生了什麼」的敘述並不可靠;transcript 才是 ground truth(事實來源)。

Writing Plans:先看計畫再跑

兩個配套改動(#2258):

  • 你會先審查已儲存的計畫:核准一個想法或一個範圍,不再等同於核准一份你還沒看過的計畫。任何東西開始執行前,計畫本身會先呈現給你。
  • 計畫攜帶 Review Focus section:最多五個輸入或 failure mode,讓最後的 whole-branch review 知道該重點看哪裡。

三個新 Harness

Harness 備註
OpenCode 2.0 OpenCode 大版本更新後的支援
Muse 新平台整合
Qwen Code Qwen 的 coding CLI

對既有使用者的影響

  • 習慣 executing-plans 中途暫停確認的人:流程改為「跑完再一次 review」。若某個計畫需要頻繁人工介入,改選 subagent-driven。
  • 想找出「上次那個 session 為什麼卡住/燒錢」的人:直接試 diagnosing-superpowers,它會給你帶行號的證據。

學習重點

  1. Native vs Subagent-driven 是教科書級的取捨:inline 執行省下 subagent dispatch 的開銷(context 重建、角色引導、啟動成本),代價是所有任務共用同一個 session context——任務之間會互相「看見」。隔離與成本不可兼得,明白自己在買哪一邊就好。
  2. 自省(introspection)要靠外部記錄:diagnosing-superpowers 示範了「讓 agent 讀自己的 transcripts 找根因」——自我診斷的證據基礎是外部持久化的記錄,不是模型對自身的內省。

來源:v6.4.1