概述
Oh My ClaudeCode v5.4.0(2026-09-11,16 個 PR)與 v5.5.0(2026-09-22,57 個 PR、22 新功能、24 修正)分別處理兩件事:v5.4.0 把自主運行的安全前置與 OAuth token 支援補上;v5.5.0 則以 jev 判斷點計畫為核心,把「代理在哪裡需要判斷」變成可度量的基礎設施。
jev:判斷點計畫統一化(v5.5.0)
「jev」是 OMC 對 judgment-point(判斷點)的度量基礎設施。v5.5.0 的四個 PR 構成一套完整體系:
| PR | 內容 |
|---|---|
| #4065 | Point registry 與 shadow eval tool——統一 judgment-point 計畫 |
| #4064 | Ralph completion verdict 與 task-size shadow points |
| #4058 | Judgment points 附 heuristic degradation(啟發式降級) |
| #4075 | Advisory points batch 與 script-side channel ADR |
為什麼值得注意
評測代理的難處在於「什麼算好」通常是 vibe。判斷點把**「哪個決策需要人類判斷」**變成:
- 可註冊——判斷點有 registry,不是散落的 ad-hoc 檢查
- 可 shadow——shadow eval 讓你並行評估判斷品質而不影響正式流程
- 可降級——heuristics 在完整評估不可用時接管
這是把 agent 評測從「感覺」推向「儀器」的工程化嘗試。
自主運行的安全前置(v5.4.0)
- lookout pre-flight danger scan(#3994,advisory):自主運行(autonomous run)開始前先掃描危險訊號——結論是建議性的,不阻擋
- HUD 支援
CLAUDE_CODE_OAUTH_TOKEN(#4004):OAuth 認證的使用量終於可讀 - SessionStart context budget 可設定(#3981):
OMC_SESSION_START_CONTEXT_BUDGET環境變數控制 bootstrap 的大小
Shipyard Skills 家族擴充
v5.4.0 / v5.5.0 為 Shipyard(治理交付流程)加入多個 opt-in skills:
agent-doc-discipline與兩軸 review gate(#4003);後續追加 closable-next-action 與 rejoin-orientation 規則harbor:外部 issues / PRs 的 intake gate(opt-in,#3982)minimal-prose-discipline:第三個寫作 companion(#4035)intent:非工程貢獻者的內部需求 intake(#4038)- deep-interview 吸收 mattpocock/skills#647 的 frontier-rounds 問法(#4052)
- 六個輸出紀律編入兩個 companions(#4036)
- drydock guardrail preset 提供具體 seed shape;launch / navigator gates 接上 shipyard-audit 執行檔
其他改進(v5.5.0)
- HUD 在 rate-limit headers 上 fallback 取得 setup-token usage(#4057)
- Shared cache sweep 節流批次化(#4051)
- Launch C5 完成報告附運行數字(#4050)
- shipyard-audit 擴及 project-skill triggers 與 intent 狀態檢查(#4048)
修正(v5.4.0)
- 移除虛假的 Ralph Ruby 前置依賴與錯誤 plan 引用(#4000)
- Team leader cleanup 保留 reap ownership(#3997)
- worktree-paths 把 bare repository 視為「無 work-tree 的 repo」而非探測失敗(#3991)
- launcher 相容 symlink 回到 canonical plugin root(#3986)
對既有使用者的影響
- OAuth token 使用者:HUD usage 終於可讀
- 自主運行:建議開啟 lookout danger scan
- 寫作 / 文件型 agent:考慮導入三個 writing companions
- v4.x 直升者:仍需先依 v5.0.0 的 retired-command 對照表遷移
學習重點
- 判斷點 + shadow eval 是代理評測的進階手法:與其問「代理整體好不好」,不如問「代理在哪些決策點需要判斷、判斷品質如何」——把評測單位縮小到決策,shadow 模式讓評估不干擾正式運行。
- 安全掃描做成 advisory 是務實取捨:pre-flight danger scan 提供資訊而不阻擋——使用者保有最終裁量權,工具的責任是讓危險可見。