AI Agent 與開發 第 7 頁
所有文章 · 第 7 頁

PII 偵測信心低時,最不該做的就是把原文交給雲端。這篇從零實作 Desert Ant Redact 本機遮蔽、繁中失敗路徑、Claude 受控 fallback 與可重跑驗收。

讓 Claude Code、Codex 的每個 Worktree 都有可辨識的本機網址;完整處理 detached HEAD、cookie/OAuth/HMR,並用 branch+commit 收據防止 Agent 測錯分支。

Tool Description 可能進入模型 Context。這篇用六步實作教你匯出 discovery 與 Schema、做 hash/diff,以 canary 與 Trace 驗證 Connector 更新,並建立停用、撤銷與可控版本回滾流程。

Skills 愈積愈多,真正難的是知道哪一版生效、是否仍有效、何時撤下。這篇用 Git、Lockfile、A/B Eval、到期政策與 rollback,搭出一套工具無關的 Skill Lifecycle。

任務做到一半如何跨 Claude Code、Pi、DeepSeek Harness 接手?用七層 Receipt、三組對照與權限/回滾閘門,建立可驗證的 Swap Test。

context-mode 的 98% 省在哪?用 Claude Code 六任務 paired A/B,從版本鎖定、成功率、Token 與延遲,到假祕密、故障與完整回滾,一次建立可重現的採用判斷。

別再只比 Token 單價與顯卡售價。這份實作指南用 7 天工作 Trace,把 API、租 GPU、自架換成每個通過品質門檻的任務成本,附試算欄位、Break-even 公式與先租後買決策樹。

用 10 個已知一行修補的 Bug,建立 Claude Code/Codex 的變更範圍評測;從 gold patch、excess edit distance 到 CI receipt,一次守住功能、scope 與 locality。

MiniCPM5-2B 適合本機 Agent 嗎?用固定 revision、12 題繁中 Tool Calling、GGUF/MLX/SGLang 三條路徑,驗收格式、多步恢復、長 context 與 fallback。