主題索引(MOC):把 coding agent 從「開箱即用」推到「照自己的方式運作」。
分三層——做自己的工具 → 證明它真的有用 → 調校內建行為。
🧱 做自己的工具
- 同一段指示每次都在重打,想固定下來 → 工具-把重複的prompt包成skill
- 寫 skill 時怎麼定驗收、怎麼堵住 agent 謊報成功 → 工具-防止agent造假通過驗收
- agent 產出的寫法老是過時、叫它改也沒用 → 工具-讓agent別寫出過時的程式碼
- skill 變多了開始互相打架、清單過期沒人維護 → 工具-skill集合的分層與維護
- 講完需求 agent 做出來的不是我要的 → 工具-讓agent反過來拷問你
- skill 要問使用者問題,不知道該給選項還是開放答 → 工具-該問開放題還是選擇題
- skill 會消耗配額或真的扣錢 → 工具-會花錢的skill該怎麼設計
📐 證明它真的有用(別憑感覺)
- 證明「這版改動真的有加分」,不是模型本來就會 → 工具-AI改動的AB對照評測
- 想知道設定/skill 到底有沒有進到送出去的請求裡 → 工具-用假API差分測試逆向CLI行為
- skill 該出手時不出手、不該出手時亂出手 → 工具-測試skill的觸發邊界
- agent 知道規則卻找藉口不遵守 → 工具-用壓力情境測試skill
這兩張要一起用:先確認它有進 prompt,再確認它讓輸出變好。少一半都不算驗過。
🎛 調校內建行為
- 覺得 agent 被內建提醒綁手綁腳,想關掉 → 工具-關掉ClaudeCode塞給模型的提醒
- 想用官方文件沒寫的設定,但不確定該不該碰 → 工具-ClaudeCode未文件化設定的取捨
⚠️ 這層的東西沒有相容性承諾,而且綁死版本。每次更新都要重驗,別寫進團隊共用設定。
📚 來源
- Claude Code 隱藏設定分析 v2.1.239 — 拆執行檔比對官方文件,附差分測試
- 做一個 ELI5 Skill 的過程 — 用 skill-creator 從零做一個 skill
- 如何評測一個 Claude Code Skill — A/B 對照 + LLM-as-judge 的評測管線