跳到主要內容

【2026 最新】i-have-ADHD vs Output Style vs AGENTS.md:Claude 少廢話怎麼選?(A/B Test 教學)

最後更新: ·
i-have-ADHD、Output Style 與 AGENTS.md 三路 A/B Test 教學首圖

i-have-ADHD 在 2026 年 9 月衝上 Show HN 後,大家問的其實不是「要不要少講幾句」,而是:把同一種簡潔規則做成 Skill、Output Style,或寫進 AGENTS.md,哪一種比較不會在長 Session 裡失效?截至 2026 年 9 月 9 日,該 Show HN 討論顯示 269 points、212 comments;這只能證明痛點熱門,不能證明任何配置比較好。

這篇專為第一次碰 Claude Code 設定的讀者寫。我們不把 GitHub stars 當品質分數,也不假裝做過本機 Claude 三路實測;你會先看懂三種機制,再拿到一套能自己重跑的 A/B Test:同模型、同提示、同必留資訊,量首要答案距離、總字數、關鍵遺漏、追問次數與長 Session 漂移。

最後的目標不是找一個永遠最短的 Claude,而是讓你知道:什麼情況先選內建 Concise、什麼情況才叫用 i-have-ADHD,以及 AGENTS.md 在 Claude Code 裡為什麼還要經過 CLAUDE.md。

先說結論:不是選最短,而是選最少漏

🧭 記憶把手:好輸出=找得到答案 × 不漏決策資訊 × 規則出現在對的時機。
字數變少,但把否定、條件、例外、錯誤原因或安全確認一起刪掉,結果就是零。

如果你只是希望 Claude Code 每回合少鋪陳,先試官方內建 Concise Output Style。如果你只想在某一段工作切成「答案先講、步驟編號、下一步明確」的模式,再叫用 i-have-ADHD Skill。如果規則屬於整個團隊、只對這個 repository 生效,才放進 AGENTS.md,再由 CLAUDE.md 匯入。三者可以並用,但不該複製三份互相競爭的同一規則。

i-have-ADHD、Output Style 與 AGENTS.md 在 Claude Code 中的三層指令位置比較
先分辨「放在哪一層」,再談哪個比較有效:Output Style 管回應風格、Skill 是需要時載入的模式、專案規則則經 CLAUDE.md 進入每個 Session。

i-have-ADHD、Output Style、AGENTS.md 到底差在哪?

① Output Style:像每回合都穿著的制服

Claude Code 官方 Output Styles 文件說得很直接:Output Style 會改動 system prompt,設定角色、語氣與輸出格式;非 Default style 也會在對話中持續提醒。2026 年 9 月 9 日的文件列出 Concise,要求 Claude 結果先講、跳過前言與工作旁白,預設縮短回答,但在你要求解釋時仍完整回答。

它最適合「每一回合都要套用」的表達習慣。終端使用者執行 /config,在 Output style 選 Concise;Claude Code 2.1.237 或更新版本才有這個內建選項。切換後,2.1.251 以上會從下一則訊息生效;較早版本才需要 /clear 或開新 Session。想回復時,在同一處改回 Default

Claude Code 官方 Output Styles 文件中的 Concise 說明與版本需求
官方 Concise 的重點不是硬砍字數:它保留完整錯誤報告、安全警告與破壞性操作確認。畫面來源:Claude Code 官方文件,擷取於 2026 年 9 月 9 日。

自訂 Output Style 要多看一個容易踩到的開關:如果 style 仍用來寫程式,frontmatter 應加入 keep-coding-instructions: true。官方文件明載,自訂 style 預設不保留 Claude Code 內建的軟體工程指令;少了這行,你同時改了「說話方式」與「做工程的方法」,A/B Test 就混入第二個變因。若想深入製作自訂 style,可接著看《Claudish 與 Output Style A/B Test》。

② i-have-ADHD Skill:像需要時才打開的行動清單

本文釘選版本的 i-have-ADHD SKILL.md不只寫「be concise」。它要求答案或下一步先出現、多步工作編號、每回合重述進度、錯誤用位置/原因/修法表達,並把清單壓在五項內;遇到詳細解釋、破壞性操作、連續除錯失敗或真實歧義時則讓安全與任務需求優先。

這個 Skill 的 frontmatter 設了 disable-model-invocation: true,所以純 Skill 路徑需要你明確輸入 /i-have-adhd。依Claude Code 的 Skill content lifecycle,被叫用的內容會作為一則訊息留在後續對話;自動 compact 時會重新附上每個 Skill 最近一次呼叫的前 5,000 tokens,所有重新附上的 Skills 共用 25,000-token 預算。這是「內容仍在 context」的機制說明,不是模型一定逐條照做的成績單。

③ AGENTS.md/CLAUDE.md:像團隊的專案手冊

這裡有一個重要更正:Anthropic 官方文件明確寫著 Claude Code 讀 CLAUDE.md,不直接讀 AGENTS.md。如果 repository 已為 Codex 或其他 coding agent 維護 AGENTS.md,可建立一份只有 @AGENTS.mdCLAUDE.md,或在不需 Claude 專屬補充時使用 symlink。進 Session 後執行 /context,確認它列在 Memory files。

# CLAUDE.md
@AGENTS.md

## Claude Code only
- Keep user-facing summaries concise, but preserve errors, warnings,
  conditions, exceptions, and destructive-action confirmations.

CLAUDE.md適合 build 指令、程式風格、架構位置、完成定義等專案事實。官方也提醒它屬於 context,不是強制設定;指令越具體、簡潔、一致,遵循度越穩,單檔建議控制在 200 行內。需要阻止工具或路徑時,應交給 permissions、sandbox 或 Hook,而不是把「請不要」寫得更大聲。這一層的安全做法可延伸閱讀《AGENTS.md 五道閘門》。

先審 repo,再安裝 i-have-ADHD

第三方 plugin 是高信任元件。Anthropic 的Plugin 安全說明提醒,plugin 與 marketplace 可用你的使用者權限執行程式,所以「作者公開原始碼」只是審查起點,不等於自動安全。本文核對的 repository commit 是 24d22f783e57cb73c957848b588c6f651b6f9cd8;你安裝時先記下自己拿到的 commit,之後才知道版本是否變了。

git clone --depth 1 https://github.com/ayghri/i-have-adhd.git
cd i-have-adhd
git rev-parse HEAD

sed -n '1,220p' skills/i-have-adhd/SKILL.md
sed -n '1,180p' hooks/always-on.mjs
claude plugin validate .

這個 commit 的 SKILL.md 沒有 allowed-tools;但完整 plugin 另含一個 SessionStart Hook。Hook 原始碼會先檢查 Claude 設定目錄中的 .i-have-adhd-always,檔案不存在就不注入內容。這不代表你可以跳過審查;它只界定了這個 pinned commit 的行為範圍。

審完後,先用 local scope 安裝到測試 repository,不要一開始就影響所有專案:

claude plugin marketplace add "$PWD" --scope local
claude plugin install i-have-adhd@i-have-adhd --scope local
claude plugin list

重新載入 plugins 或開新 Session,輸入 /i-have-adhd,再跑一題測試。純 Skill 比較期間不要建立 always-on flag;那個 Hook 會在 startupresumeclearcompact 事件重新注入規則,等於多出第四個條件。回滾則執行:

claude plugin uninstall i-have-adhd --scope local
claude plugin marketplace remove i-have-adhd

如果你想先理解「規則檔、Skill、Hook、MCP 應先裝哪個」,可讀《AI Coding Agent 最小配置》;本文只處理回應形狀,不把更多工具一起塞進測試。

i-have-ADHD 三路 A/B Test:先鎖住兩個問題

三路比較最容易犯的錯,是同時更換「規則文字」與「注入位置」,最後不知道差異從哪裡來。把測試拆成兩輪:

  1. 實際使用輪:比較內建 Concise、原版 i-have-ADHD、你現有的 AGENTS.md/CLAUDE.md。這回答「我現在選哪個比較省事」。
  2. 機制隔離輪:把同一份五條核心規則分別放進自訂 Output Style、測試 Skill、AGENTS.md→CLAUDE.md。這才回答「同一句話放在哪一層比較穩」。

每個條件固定同一個 Claude 模型、Claude Code 版本、權限模式、工具集、repository 起點與 prompt。模型沒有固定 seed 可依賴時,同一題至少跑三次;輸出改成 A/B/C 後再評,避免看到名稱就先入為主。若你還不熟 Eval,先看《AI Eval 新手指南》。

六題就能抓到「短到出事」

  1. 直接答案:例如簡單計算;答案應在第一行,不需要製造步驟。
  2. 已知原因的除錯:給完整錯誤與缺失 header,檢查位置、原因、最小修法與驗證是否都在。
  3. 明確要求詳解:要求完整解釋 OAuth PKCE,測試簡潔規則會不會壓過使用者需求。
  4. 破壞性操作:要求刪除所有 untracked 與 ignored files,檢查是否先預覽並確認範圍。
  5. 真實歧義:只說「部署到 production」,正確行為是問一個必要問題,不是猜目標。
  6. 部分成功:lint、unit test 通過但 integration test 401,檢查勝利與阻塞是否同時可見。

每題在看輸出前先寫 answer key:必須保留哪些數字、否定、條件、例外、警告、錯誤原文與下一步。這張清單是裁判;「我覺得比較舒服」只能當偏好資料,不能蓋過漏掉安全確認。

i-have-ADHD 三路 A/B Test 空白記分卡,先驗收正確安全與關鍵遺漏,再比較篇幅和漂移
這是空白評測模板,不是預填結果。正確與安全先過硬門;只有三組都沒漏決策資訊,才比較哪個更短、更快找到答案。

五個指標怎麼算?

  • 首要答案距離:從回應開頭到第一個正確答案或可執行動作之前,有幾行或幾個字元。串流工具能記 timestamp 時,再補 time-to-first-action。
  • 總篇幅:記錄 output tokens 與可見字元;不要把兩者當同一單位。
  • 關鍵遺漏率:漏掉的必留項目 ÷ 全部必留項目。任何安全確認或決策條件遺失,直接標 blocker。
  • 追問次數:讀者要多問幾次,才能拿到原本就該存在的必要資訊。
  • 長 Session 漂移:第 8、15 回合與 compact 後的同類 probe,相對第 1 回合掉了多少分。

現有 i-have-ADHD 數據能證明到哪裡?

專案自己的 RESULTS.md記錄了一次 2026 年 8 月 2 日測試:Claude Code 2.1.220、固定 claude-opus-4-8、14 題、每題三次,baseline 與 Skill 各 42 筆。其盲評加權分數由 4.045 升到 4.473,Concision 由 3.429 升到 4.571,blocking findings 從 7 降到 3。

i-have-ADHD 專案 2026 年 8 月自有評測分數與未通過 release gate 的限制
數字來自專案自己的固定版本測試,應讀成「這個設定下觀察到的結果」。Release gate 仍失敗,而且沒有 Output Style 或 AGENTS.md 條件。

最值得保留的不是「分數變高」,而是它公開寫下失敗:candidate 還有三個 blockers,所以 release gate 判定 FAILED;其中 partial-success case 出現一個合理的退步機制——規則要求先講 cause,可能推著模型在證據不足時把猜測說成確定原因。另外,agent-owned-edit 的 runner 又把 tools 清空,題目本身無法真正完成。

因此,這份檔案只支持「作者在該模型、版本、題庫與 grader 下觀察到 Skill 相對 baseline 的變化」。它沒有 Output Style 或 AGENTS.md rows,也沒有跨長短 Session 的三路比較,不能被改寫成「i-have-ADHD 已證明勝出」。HN 留言裡的成功與失敗經驗同樣只能當成待測假說。

長 Session 漂移:第 1、8、15 回合都要留證據

短 Session 先各開一個乾淨環境,每題重開,量的是「剛載入時能不能照做」。長 Session 則在三個條件各開一條新對話,中間插入等量的閱讀、除錯與檔案任務,於第 1、8、15 回合送入難度相當但文字不同的 probes;接著執行一次 /compact,再跑最後一題。

這裡不要預先宣布誰會贏。官方只告訴我們三種機制不同:Output Style 直接改 system prompt 並在對話中提醒;Skill 內容在被叫用後留在 conversation,compact 重新附加時受 token 預算限制;CLAUDE.md 在 Session 起點載入,而且屬於可被模型判斷的 context。真正的遵循度必須看每個 checkpoint 的輸出。

建議把 drift 寫成 晚期通過率-早期通過率,並同時保留每題原始輸出。只留平均字數會把兩種完全不同的失敗混在一起:一種是又開始鋪陳;另一種是依舊很短,卻少了限制或證據。想再把篇幅與成本分開,可接著讀《Claude 怎麼省 token》。

決策樹:Skill、Output Style、AGENTS.md 怎麼選?

i-have-ADHD Skill、Concise Output Style 與 AGENTS.md 的使用時機決策圖
先決定規則應該「一直出現」還是「需要時出現」。推薦順序來自機制與維護成本,不是假裝存在的三路勝率。
  • 選 Concise Output Style,如果:問題是整條主對話都太冗長;你想先用官方預設、保留完整錯誤與安全訊息,並能一鍵回 Default。
  • 選 i-have-ADHD Skill,如果:你需要的是「行動先行+進度外顯」的一整套規則,只想在特定 Session 開啟,而且願意審查第三方 plugin。
  • 選 AGENTS.md→CLAUDE.md,如果:規則屬於 repository 與團隊,例如摘要格式、完成定義、術語與必要證據,不是你的私人閱讀偏好。
  • 用自訂 Output Style,如果:內建 Concise 太短或不符合你的保真條件;記得保留 coding instructions,並以同一題庫驗收。

最乾淨的並用方式是分工:Output Style 管全局語氣,CLAUDE.md 管專案事實,Skill 管臨時模式。若同一句「答案先講」在三層重複,發生衝突時很難定位來源,也會增加 context。跨 Claude Code 與 Codex 時,再參考《Claude Code vs Codex》確認各自讀取的檔名與配置層級。

五個常見坑:看起來更短,實際更難用

  1. 只放 AGENTS.md 就開始測 Claude:Claude Code 官方要求讀 CLAUDE.md;沒有 import 或 symlink,這條件可能根本沒載入。
  2. 自訂 Style 忘記保留 coding instructions:輸出改變不只來自語氣,工程行為也一起被換掉。
  3. 用一句安裝提示把第三方 repo 全交給 Agent:先固定 commit、審 SKILL、manifest 與 hooks,再用 local scope 安裝。
  4. 把 always-on Hook 混進純 Skill 組:compact 後重新注入會改變處理,應獨立成第四條件。
  5. 只看字數:短答案若多一次追問、漏一個否定或省掉一次安全確認,總成本與風險反而上升。

i-have-ADHD 常見問題 FAQ

1. 使用 i-have-ADHD 能證明我有 ADHD 嗎?

不能。它是回應格式 Skill,不是診斷工具。你可以單純因為喜歡答案先講、步驟清楚而使用,名稱與 GitHub 熱度都不是臨床證據。

2. 只想讓 Claude 少廢話,第一步做什麼?

先在 /config 試 Concise。拿最近三個真實 prompt 重跑,先檢查必留資訊,再看篇幅。若你還需要進度重述與單一步驟下一動作,再測 i-have-ADHD。

3. 安裝 i-have-ADHD 後會自動啟用嗎?

純 Skill 不會。本文釘選的 commit 把 SKILL.md 設為只能由使用者呼叫;輸入 /i-have-adhd才載入。專案另提供 opt-in SessionStart Hook,但要建立指定 flag 才輸出規則。

4. Claude Code 會直接讀 AGENTS.md 嗎?

不會。Anthropic 官方文件明確要求用 CLAUDE.md;既有 AGENTS.md 可由 @AGENTS.md 匯入,並用 /context 檢查是否載入。

5. Skill 在長 Session 一定不會漂移嗎?

不能這樣保證。官方文件描述 Skill 內容如何留在 conversation 與 compact 後如何重新附加;它也明說,內容還在時模型仍可能選擇其他做法。用第 1、8、15 回合與 compact 後的 probes 驗證你的實際配置。

6. 三種方法可以一起用嗎?

可以,但要分工。Style 管語氣、CLAUDE.md 管專案、Skill 管臨時模式。不要在三處複製同一套十條規則,否則衝突與移除都更難追。

7. 回答變短就一定省 token 嗎?

不一定。output tokens 可能下降,但 Style、Skill 與 CLAUDE.md 也會增加 input context;若漏資訊造成追問或重做,整個任務用量可能上升。比較同一工具顯示的完整 Session usage。

8. 哪一種是客觀冠軍?

現有專案結果回答不了三路冠軍。先用自己的真實任務做 hard-gate 評測;通過正確、安全與保真的條件後,才讓首要答案距離、篇幅與個人偏好決勝。

給新手的五個重點

  • 先分層:Style 是全局語氣,Skill 是需要時載入,CLAUDE.md 是專案脈絡。
  • Claude 不直接讀 AGENTS.md:用 CLAUDE.md 匯入,再以 /context 驗證。
  • 先寫必留清單:否定、條件、例外、警告與錯誤不能拿來換短。
  • 短 Session 與長 Session 分開測:第 1 回合漂亮,不代表第 15 回合仍一樣。
  • 可回滾才值得試:Style 回 Default、Skill 用 local scope、專案規則在測試分支處理。

接著閱讀

左右滑動查看更多推薦

結語:今天只做一個三題小測

回到開頭的公式:好輸出=找得到答案 × 不漏決策資訊 × 規則出現在對的時機。現在先不要安裝三套東西。打開 Claude Code 的 /config,把 Output style 切成 Concise;從最近對話挑一題直接答案、一題除錯、一題高風險操作,先寫必留清單,再重跑一次。三題都沒漏重點,才進一步測 i-have-ADHD;想把這套 Eval 做成完整工作流,可到 AlphaLab 課程把 prompt、測例與驗收一起系統化。

ALPHALAB 社群

有問題?來 Telegram 聊

和 Terry、編輯、其他網友一起討論這篇文章。提問、分享觀點,回覆更即時。

加入 Telegram 討論

📩 訂閱 AlphaLab 電子報

每週最多三封:一封 Weekly 週報與最多兩封關鍵 Alpha Signal。

我們不會 spam,隨時可退訂。