跳到主要內容
← AI

AI Agent 與開發 18

所有文章 · 第 18 頁

AI Agent 與開發
【2026 最新】GLM-5.3 Claude Code/OpenCode 設定:Hosted-first 與三關驗收

GLM-5.3 現在最務實的路線,是先把 Claude Code 或 OpenCode 接到 Z.ai hosted 服務,再用可重跑的 repo 任務驗收。本文依官方來源整理 model、auth、tool 與本機 readiness 邊界,讓你知道現在能做什麼、哪些條件仍要等。

最後更新:2026年8月19日
AI Agent 與開發
【2026 最新】AI Agent 搜尋 API 怎麼選?10 題小型 Eval 比較 Tavily、Exa、Parallel、Firecrawl

同一個 Agent 只換搜尋供應商,答案、引用、延遲與成本就可能改變。這篇用 10 題小型 Eval,教你公平比較 Tavily、Exa、Parallel、Firecrawl,建立可重跑的選型與 fallback 方法。

最後更新:2026年8月19日
AI Agent 與開發
【2026 最新】Specification-First Convergence 是什麼?沒有現成測試 Oracle,AI 重構怎麼驗?

老專案缺少能判定新行為的測試 Oracle,先別讓 AI 直接改。本文用 7 步建立現況證據、規格與原始碼互審、凍結規格、小步驗證紀錄與雙零停止閘門,並拆解它不能證明什麼。

最後更新:2026年8月19日
AI Agent 與開發
【2026 最新】AI 模型 Canary 上線教學:配對閘門、故障歸因與回滾收據

教你把候選模型封成不可變 Release Bundle,以同請求配對、60/120/240 統計閘門、互斥故障歸因與 future-only 回滾收據,設計可稽核的 production promotion protocol。

最後更新:2026年8月19日
AI Agent 與開發
【2026 最新】DeepSeek Harness 安全 Plugin 實戰:權限、取消、Config-only HMR 與 Crash Recovery

固定 rc.7 原始碼,從越界 path、取消/unmount、config replacement 到 crash 後 UNKNOWN projection,以 9 組、481 項測試建立 DeepSeek Harness 安全 Plugin 的...

最後更新:2026年8月19日
AI Agent 與開發
【2026 最新】Context Compaction 怎麼驗收?用 Reacquisition Cost 抓出成功率看不見的成本

只看 completion,Agent 可能做完卻重讀、重搜、重跑。這篇用固定 24-turn 配對測試量 Reacquisition Cost,守住 constraints 與 tool inventory,再以非劣性和 all-in 成本 gate 決定是否壓縮。

最後更新:2026年8月18日
AI Agent 與開發
【2026 最新】Agentic Transaction 是什麼?動手做不重複扣款、可對帳補償的 ACID Agent

扣款 API timeout,不代表沒扣款。這篇用 SQLite 假訂單 Agent 實作 stable key、unknown 對帳、ledger、outbox 與補償,並用七項故障測試驗證 replay 不會二次扣款。

最後更新:2026年8月18日
AI Agent 與開發
Qwen3.8-27B 本機 Agent 驗收教學:Reasoning Effort、Tool Call 與 Runtime 6 關協定

Qwen3.8-27B 本機 Agent 能聊天,不代表兩輪工具呼叫可靠。本文提供 llama.cpp、vLLM 四模式的可重跑 fixture,教你驗收 arguments、tool history 與 16/24/48 GiB artifact 候選。

最後更新:2026年8月18日
AI Agent 與開發
【2026 最新】DeepSeek Harness 教學:四種 Mode、Append-only Session 與第一個 Plugin

完整實作 DeepSeek 官方 Harness:從 Web/CLI、四種 Mode 到 append-only Session、KV cache、Cordis Plugin 與跨 Harness A/B 測試。

最後更新:2026年8月14日