以 LLM 行為特性實證研究為基礎的 Claude Code Skills 集合。 結構性防禦優於指令性約束 — 每條規則都有量化研究支撐。
在 Claude Code 中加入此 repo 作為 plugin source:
Plugin URL: https://github.com/soetek/soetek-agentic-coding-skills
加入後即可在 skill 清單中看到所有可用的 skills,選擇性安裝。
| Skill | 版本 | 觸發 | 說明 |
|---|---|---|---|
| spec-p1-digest-flow | v1.2.0 | /spec |
P1 — SA 規格書消化 S0–S4:DOCX 轉 MD → 規格統計 → 釐清清單 → SA 回覆整合 |
| spec-p2-tasking | v3.0.0 | /tasking |
P2 — 於專案 repo 內讀 CLAUDE.md 索引,產前後端任務清單(含類型 tag)+ 手測 checklist |
| spec-p3-backend | v1.0.0 | /impl-be |
P3-backend — 後端實作:[validator] 完整 TDD;[processor] 走 SG2 雙對照表(api_contract A## + current_schema,無 mock-based 測試);[sql]/[entity]/[spi] 對照 current_schema 後寫實作無測試 |
| spec-p3-frontend | v1.0.0 | /impl-fe |
P3-frontend — 前端實作:[service]/[store-map] 走 SG2 對照 api_contract A##(無 mock-based 測試),其他類(UI/types/i18n)無測試由 PG 完工後整體手測 |
| spec-p3-data | v1.0.0 | /data |
P3-data — 權限 SQL + 測試資料 SQL 產出與執行,PG 授權後跑 |
| Skill | 版本 | 說明 |
|---|---|---|
| eap-agentic-coding | v1.7.0 | eap 專案規格驅動開發(Quarkus + Vue 3 + MSSQL),已被通用型路線取代 |
| eap-agentic-coding-lite | v2.0.0 | eap 規格驅動開發 Demo 版,已被通用型路線取代 |
| serp-agentic-coding | v1.2.0 | serp 專案規格驅動開發,已被通用型路線取代 |
| Skill | 版本 | 觸發 | 說明 |
|---|---|---|---|
| session-analyzer | v1.0.0 | /session-analyzer |
分析 Claude Code session 的 token 用量、時間、sub-agent 明細 |
各 skill 的流程圖與詳細說明請見各自資料夾下的 README / SKILL.md。
graph TD
subgraph P1["P1 spec-p1-digest-flow — SA 資料夾"]
direction LR
S0["S0 DOCX→MD"]
S1["S1 規格統計"]
S2["S2 釐清清單"]
S3["S3 PG 回覆"]
S4["S4 整合+二審"]
S0 --> S1 --> S2 --> S3 --> S4
S4 -.有新問題.-> S3
end
HANDOFF["最終規格 + UI 截圖<br/>搬入專案 repo"]
subgraph P2["P2 spec-p2-tasking — 專案 repo"]
direction LR
T1["讀 CLAUDE.md 索引<br/>→ 讀規範文件"]
T2["產前後端清單(含類型 tag)<br/>+ 手測 checklist"]
T1 --> T2
end
SESSION1["session 1"]
subgraph P3BE["P3 spec-p3-backend — /impl-be"]
direction LR
BE1["SG1 確認"]
BE2["tag 分流:<br/>validator TDD;processor 雙對照表<br/>sql/entity/spi 對照 current_schema 無測試"]
BE1 --> BE2
end
SESSION2["session 2"]
subgraph P3FE["P3 spec-p3-frontend — /impl-fe"]
direction LR
FE1["SG1 確認"]
FE2["tag 分流:<br/>service/store-map SG2 對照 api_contract<br/>UI/types/i18n 無測試"]
FE1 --> FE2
end
SESSION3["session 3"]
subgraph P3DATA["P3 spec-p3-data — /data"]
direction LR
D1["抽權限 + 測資需求"]
D2["SG1 審 SQL → SG2 授權執行"]
D1 --> D2
end
MANUAL["PG 手測(開瀏覽器照 test_cases.md 勾選)<br/>發現 bug ad hoc 派 AI 修"]
P1 --> HANDOFF --> P2 --> SESSION1 --> P3BE --> SESSION2 --> P3FE --> SESSION3 --> P3DATA --> MANUAL
style P1 fill:none,stroke:#64b5f6
style HANDOFF fill:none,stroke:#ffa726
style P2 fill:none,stroke:#81c784
style SESSION1 fill:none,stroke:#9e9e9e
style P3BE fill:none,stroke:#ce93d8
style SESSION2 fill:none,stroke:#9e9e9e
style P3FE fill:none,stroke:#ce93d8
style SESSION3 fill:none,stroke:#9e9e9e
style P3DATA fill:none,stroke:#a1887f
style MANUAL fill:none,stroke:#ef9a9a
| 專案 | 說明 |
|---|---|
| TouchFish-DevTeam | 多角色 Agent 團隊協作 — TL (Opus) 指揮 Workers (Sonnet) 並行開發,分離測試 + 三方交叉驗證 QA |
| TouchFish-Skills | 4 個專案基礎設施插件 — DDD 分析模板、Git 全方位專家、專案規範審查、專案探索者 |
這些 skills 的設計規則追溯至以下實證研究,非經驗談:
| 文件 | 內容 |
|---|---|
| 01 LLM 行為特性研究彙整 | 11 項 LLM 行為風險 + 量化證據(語義漂移、Context Rot、模式複製、規格博弈等) |
| 01 摘要 | 上述研究的萃取摘要 |
| 02 Skill 設計原則 | Anthropic 工程師 Thariq 的 9 項 Skill 設計原則 |
| 03 Harness Engineering | HumanLayer 的 7 項 Harness Engineering 原則 + 反模式 |
| 04 通用型 SKILL 架構設計 | 5 SKILL 架構 + 設計決策記錄 + CLAUDE.md 契約 |
| review/ | Skills 的多輪交叉審查報告 |
- AI 做執行,人做判斷 — 每個 Phase 有明確的人類決策點(STOP Gate)
- 信噪比 > 總量 — conventions 和 templates 按需載入,不一次全灌
- 回饋迴路決定自主上限 — 測試、lint、型別檢查提供 pass/fail 信號
- 研究 → Skill 直接推導 — 不設中間抽象層,減少語義漂移
- 讀規範、不掃 code — 專案 context 來自 CLAUDE.md 索引指向的規範文件(deterministic),不掃 code 歸納 pattern(AI 行為會漂移)
- 類型 tag 驅動測試策略 — P2 在 task 標 tag,P3 依 tag 分流(邏輯 heavy 走 TDD,UI heavy 走手測)
- 手測優先於自動化 E2E — UI/UX/文字/樣式問題人眼 1 秒看出,寫 E2E 投入產出比低