Theme / v5.5.0

Oh My ClaudeCode

Claude Code 多代理編排系統

基礎觀念

v5.4.0 → v5.5.0:判斷點、寫作紀律與自主安全

掌握 v5.4.0 與 v5.5.0 的重點:jev 判斷點(judgment points)統一化與 shadow eval、CLAUDE_CODE_OAUTH_TOKEN 支援、lookout pre-flight danger scan,以及三個寫作 companion skills。

概述

Oh My ClaudeCode v5.4.0(2026-09-11,16 個 PR)與 v5.5.0(2026-09-22,57 個 PR、22 新功能、24 修正)分別處理兩件事:v5.4.0 把自主運行的安全前置與 OAuth token 支援補上;v5.5.0 則以 jev 判斷點計畫為核心,把「代理在哪裡需要判斷」變成可度量的基礎設施。

jev:判斷點計畫統一化(v5.5.0)

「jev」是 OMC 對 judgment-point(判斷點)的度量基礎設施。v5.5.0 的四個 PR 構成一套完整體系:

PR 內容
#4065 Point registry 與 shadow eval tool——統一 judgment-point 計畫
#4064 Ralph completion verdict 與 task-size shadow points
#4058 Judgment points 附 heuristic degradation(啟發式降級)
#4075 Advisory points batch 與 script-side channel ADR

為什麼值得注意

評測代理的難處在於「什麼算好」通常是 vibe。判斷點把**「哪個決策需要人類判斷」**變成:

  • 可註冊——判斷點有 registry,不是散落的 ad-hoc 檢查
  • 可 shadow——shadow eval 讓你並行評估判斷品質而不影響正式流程
  • 可降級——heuristics 在完整評估不可用時接管

這是把 agent 評測從「感覺」推向「儀器」的工程化嘗試。

自主運行的安全前置(v5.4.0)

  • lookout pre-flight danger scan(#3994,advisory):自主運行(autonomous run)開始前先掃描危險訊號——結論是建議性的,不阻擋
  • HUD 支援 CLAUDE_CODE_OAUTH_TOKEN(#4004):OAuth 認證的使用量終於可讀
  • SessionStart context budget 可設定(#3981):OMC_SESSION_START_CONTEXT_BUDGET 環境變數控制 bootstrap 的大小

Shipyard Skills 家族擴充

v5.4.0 / v5.5.0 為 Shipyard(治理交付流程)加入多個 opt-in skills:

  • agent-doc-discipline 與兩軸 review gate(#4003);後續追加 closable-next-action 與 rejoin-orientation 規則
  • harbor:外部 issues / PRs 的 intake gate(opt-in,#3982)
  • minimal-prose-discipline:第三個寫作 companion(#4035)
  • intent:非工程貢獻者的內部需求 intake(#4038)
  • deep-interview 吸收 mattpocock/skills#647 的 frontier-rounds 問法(#4052)
  • 六個輸出紀律編入兩個 companions(#4036)
  • drydock guardrail preset 提供具體 seed shape;launch / navigator gates 接上 shipyard-audit 執行檔

其他改進(v5.5.0)

  • HUD 在 rate-limit headers 上 fallback 取得 setup-token usage(#4057)
  • Shared cache sweep 節流批次化(#4051)
  • Launch C5 完成報告附運行數字(#4050)
  • shipyard-audit 擴及 project-skill triggers 與 intent 狀態檢查(#4048)

修正(v5.4.0)

  • 移除虛假的 Ralph Ruby 前置依賴與錯誤 plan 引用(#4000)
  • Team leader cleanup 保留 reap ownership(#3997)
  • worktree-paths 把 bare repository 視為「無 work-tree 的 repo」而非探測失敗(#3991)
  • launcher 相容 symlink 回到 canonical plugin root(#3986)

對既有使用者的影響

  • OAuth token 使用者:HUD usage 終於可讀
  • 自主運行:建議開啟 lookout danger scan
  • 寫作 / 文件型 agent:考慮導入三個 writing companions
  • v4.x 直升者:仍需先依 v5.0.0 的 retired-command 對照表遷移

學習重點

  1. 判斷點 + shadow eval 是代理評測的進階手法:與其問「代理整體好不好」,不如問「代理在哪些決策點需要判斷、判斷品質如何」——把評測單位縮小到決策,shadow 模式讓評估不干擾正式運行。
  2. 安全掃描做成 advisory 是務實取捨:pre-flight danger scan 提供資訊而不阻擋——使用者保有最終裁量權,工具的責任是讓危險可見。

來源:v5.4.0、v5.5.0