跳到主要內容
← AI

AI Agent 與開發 2

所有文章 · 第 2 頁

AI Agent 與開發
【2026 最新】Claude Mods 是什麼?Function Hooks、Skills、Classic Hooks 差在哪(低風險試作+能力盤點)

Claude Mods 仍在 early access;本文用 Claude Code 2.1.278 分清 Skill、Classic Hook、Function Hook 與 Plugin,實作只顯示狀態的低風險 Mod,完成能力盤點、測試、版本釘選與退場方案。

最後更新:2026年9月20日
AI Agent 與開發
【2026 最新】OpenSpec vs Claude Code vs Spec Kit:規格稅 A/B Test 評估教學

同一個 Repo、同一組 Hidden Oracle,如何公平比較 plain Claude Code、OpenSpec 與 Spec Kit?從版本固定、三次重跑到規格稅決策樹,一次學會。

最後更新:2026年9月20日
AI Agent 與開發
【2026 最新】LLM-as-a-Judge 校準教學:100 題驗收 AI 評審、Abstain 與 CI 閘門

從 100 題 human-labeled 校準集開始,驗收 LLM Judge 的 agreement、position bias、重跑穩定性與 false pass,再把 abstain、人工複核和 deterministic gates 接進 CI。

最後更新:2026年9月19日
AI Agent 與開發
【2026 最新】Agent Experience(AX)是什麼?用 3 個 Coding Agent 驗收網站

Agent Experience(AX)不是 llms.txt 或掃描分數。用 3 個 Coding Agent、3 項任務與前後比較,驗收網站的任務結果、流量成本、臆造網址與安全邊界。

最後更新:2026年9月19日
AI Agent 與開發
【2026 最新】Agent Harness A/B Test:Plan、Bash、Context 三旋鈕教學

同一模型換了 Harness 就像換腦?本文把 176 組研究設定拆成可在自己 repo 重跑的 Plan/Tools/Context 受控消融,附工作表、指標與決策規則。

最後更新:2026年9月19日
AI Agent 與開發
【2026 最新】Claude Code AGENTS.md 教學:CLAUDE.md 該留、該刪,還是雙軌?

Claude Code 2.1.277 支援 AGENTS.md,但預設並不會和 CLAUDE.md 合併。用三條遷移路徑與四組 canary,選出最穩健的跨 Agent 指令架構。

最後更新:2026年9月19日
AI Agent 與開發
【2026 最新】ACLIF 教學:把 MCP 工具海編成一條可審計 Agent CLI

ACLIF 把多個 SaaS 工具收斂成共同 CLI grammar。本文固定 1.3.1,實測無憑證 introspection、Salesforce/ServiceNow 唯讀 mock 與 DML metadata,再帶你設計 gateway、MCP 對照 A/B 與故障注入。

最後更新:2026年9月18日
AI Agent 與開發
【2026 最新】Agent CAPA 教學:把 Claude Code 事故變成測試、Hook 與 CI 閘門

從一個 Claude Code 邊界模擬案例開始,實作 Agent CAPA ledger、回歸測試、Hook、required CI 與人工批准,讓錯誤成為可追蹤、可退場的防線。

最後更新:2026年9月18日
AI Agent 與開發
Bend 2 Law 與 Proof:AI 寫程式,機器能把錯誤擋住嗎?(2026)

Bend 2 Law 與 Proof 把 AI 改碼的部分驗收條件交給 checker,但 Proof 只守得住寫進 Law 的邊界。本文以規格漏洞反例與 Bend 2.0.10 重跑,拆解 proof gate、@unsafe、CPU/GPU...

最後更新:2026年9月19日