AI

Superpowers:把資深工程師的開發紀律,打包成 AI Coding Agent 的 Skill 框架

本內容僅供參考,詳細使用規則與工具安全性與否,建議要進行相關安全性測試與評估

AI Coding Agent 寫程式的速度早就不是問題,問題是它們的「工作習慣」:沒問清楚需求就開工、計畫寫得含糊、先寫實作再補測試(或乾脆不寫)、還沒驗證就宣稱完成。Superpowers(obra/superpowers)的答案不是換一個更聰明的模型,而是給 Agent 一整套軟體開發方法論——用一組可組合的 Skill,強迫 Agent 按照資深工程師的紀律工作。這個專案目前約 297k stars、26.5k forks,是 Agent Skill 生態中最具代表性的專案之一。


1. 專案背景與定位

Superpowers 由 Jesse Vincent(obra)與 Prime Radiant 團隊開發,MIT 授權。官方描述是「一個真的有效的 Agent Skill 框架與軟體開發方法論」。它不是工具,也不是 Agent,而是一套讓 Agent 在任何任務開始前都會先檢查是否有相關 Skill 的規則系統,Skill 會自動觸發。

它支援 16 種 Agent harness,包括 Claude Code(已進入官方 plugin marketplace)、Codex App 與 CLI、Cursor、Gemini CLI、GitHub Copilot CLI、OpenCode、Devin CLI、Factory Droid、Hermes Agent 等。

2. 技術架構與核心設計

Superpowers 的核心是一條完整的開發工作流,每一步都對應一個 Skill:

  1. brainstorming:先透過提問釐清意圖,再把設計分段呈現給使用者確認,最後產出書面設計文件。
  2. using-git-worktrees:建立隔離的分支工作區、執行 setup,並確認測試基準是乾淨的。
  3. writing-plans:把工作拆成每個約 2–5 分鐘的小任務,每個任務都寫明確切的檔案路徑、程式碼與驗證步驟。
  4. subagent-driven-development / executing-plans:可選擇每個任務派一個全新的 subagent 並逐一審查(最徹底),或在同一個 session 內依序執行、最後統一審查(最省成本)。
  5. test-driven-development:強制 RED-GREEN-REFACTOR,在測試之前寫的程式碼會被刪掉。
  6. requesting-code-review:依照計畫審查成果,嚴重問題會阻擋後續進度。
  7. finishing-a-development-branch:驗證測試,提供 merge/PR/保留/捨棄選項並清理環境。

其他 Skill 還包括 systematic-debugging、verification-before-completion(完成前必須驗證)、dispatching-parallel-agents、receiving-code-review,以及用來撰寫新 Skill 的 writing-skills。設計哲學四句話:測試驅動、系統化優於臨場發揮、降低複雜度、證據優於宣稱。

3. 社群熱度與生態採用

約 297k stars、26.5k forks、1.1k watchers,但 commit 數只有 684——這是一個「內容精煉、星數爆炸」的典型案例,價值在方法論而非程式碼量。它已進入 Claude Code 官方 plugin marketplace,並有獨立的 superpowers-evals 測試框架來驗證 Skill 的行為。

值得注意的是,維護者表明通常不接受新的 Skill 貢獻,且任何 Skill 修改都必須能在所有支援的 Agent 上運作——這種嚴格的範圍控管,正是它能維持一致品質的原因。

4. 局限性與潛在風險

  • 流程成本:完整走一遍 brainstorming → 計畫 → subagent 逐一執行與審查,token 消耗和時間都會明顯增加。對一行就能改完的小修正,這套流程顯得過重。
  • 「刪掉先寫的程式碼」可能誤傷:嚴格的 TDD 規則在探索性開發、原型或難以測試的領域(UI、硬體整合)可能造成摩擦。
  • 自動觸發的不可預期性:Skill 會自動觸發,使用者不一定清楚某個行為是來自模型還是 Skill,除錯時需要多一層判斷。
  • 輕度 telemetry:brainstorming 的視覺輔助會從專案網站載入 logo,請求中帶有 Superpowers 版本號(README 表示不含專案、prompt 或 Agent 細節)。可用 SUPERPOWERS_DISABLE_TELEMETRY 或 Claude Code 的 DISABLE_TELEMETRY 關閉。
  • 診斷工具會讀取對話記錄:diagnosing-superpowers 會讀取 session transcript 並可打包回報 bug,雖然會先清理,送出前仍建議人工檢查內容。
  • Hooks 與 plugin 的信任:部分 harness 需要手動核准 hooks,安裝前應了解這些 hooks 會執行什麼。

5. 應用價值與適用場景

對於「希望 Agent 產出可以直接進 code review 的成果」的團隊,Superpowers 的價值非常直接:有設計文件、有細粒度計畫、有測試、有審查紀錄,每一步都可追溯。特別適合中大型功能開發、需要多人接手的專案,以及想讓 Agent 長時間自主工作、但又不想失去控制的情境。

如果你主要用 Agent 做快速問答、小修小補或一次性腳本,可以只挑 systematic-debugging、verification-before-completion 這類輕量 Skill 使用。

Monday 的觀點與架構建議

  • Superpowers 最重要的洞見是:Agent 的品質問題,很多是流程問題而不是能力問題。把工程紀律編碼成 Skill,比在 prompt 裡寫「請仔細一點」有效得多。
  • 「計畫拆到 2–5 分鐘、每步附驗證方式」的做法值得任何團隊借鏡,即使不用 Superpowers,也可以把這個標準寫進自己的 CLAUDE.md 或 AGENTS.md。
  • 建議依任務規模選擇模式:大功能用 subagent-driven-development,小任務用 executing-plans 或直接跳過流程,避免為了紀律付出不成比例的成本。
  • 搭配本月稍早介紹的 Ponytail 一起看很有意思:一個追求「少寫」,一個追求「寫對」——兩者並不衝突,Agent Skill 生態正在從「單一技巧」走向「完整的工程文化」。

參考來源