AI Agent 與開發 第 12 頁
所有文章 · 第 12 頁

Agent 說已保存進度,不代表能安全續跑。這篇從官方原始碼建置 Apache Maka,帶你讀 Runtime Event Log、設計三組故障注入,並驗收權限與本機 Credential Vault。

用六題固定考卷拆解 Claude Code 的行動遵從問題:從乾淨 Worktree、可判分 Diff 到 Session、Safe mode、Output Style 與模型比較,建立可重跑的回歸測試與復原流程。

別把 163 個 Skills 一鍵全裝。本文挑 scientific-critical-thinking,逐檔檢查權限、依賴與資料流,固定 SHA 後完成 With/Without 配對實測;結果平手,因此尚未通過正式准入。

多 Agent 真正的瓶頸,常是誰能自行繼續、誰必須叫人。本文用五軸中斷矩陣、四種路由、approval budget 與 trace replay,帶你做出可驗收的 Attention Interface。

30.0% 不是一般能力分數。用 Harbor 固定一個 symbolic-regression 任務、Model、Harness、環境與三次重跑,學會從 verifier、trace、artifact 與成本判讀 Coding Agent。

把開放模型做成真的能還原的 release bundle:固定完整 commit、封存權重與授權證據、建立 SHA-256 manifest、備份 runtime,最後從乾淨環境斷網驗收。

把「希望模型記得」改成事件觸發:從四種控制工具的選擇,到 formatter、test receipt、危險命令 gate 與 A/B 驗收,一次完成 Claude Code Hooks 入門。

便宜模型做到一半再換強模型,不一定省錢。用同一個 repo 建立 Low-only、High-only、Raw、Receipt 與 Restart 對照,量成功率、token、成本與返工。

本機部署不等於安全。本文拆解 token、parser、tool call 到主機權限的真實路徑,帶你用 vLLM、SGLang 官方控制與 Docker 最小權限完成版本固定、網路隔離、無破壞測試、監控與復原。