AI Agent 與開發 第 11 頁
所有文章 · 第 11 頁

一次生成漂亮簡報,不代表來源改變後修得準。這篇用 SlideOps 示範五頁可追溯 deck,從 citation、MOVED/CHANGED、局部修補到 render、PDF 與 CI。

AI Agent 失敗不一定是模型太弱。這篇從零呼叫 Preflight、Type I 單題,到固定 Worker 只換 Controller,教你用 Trace 與 evaluator receipt 做故障歸因。

智慧路由省下單次模型費,卻可能被 Cache Miss、重試與 fallback 吃回去。本篇用隔離 identity、客戶端 OpenTelemetry、Cache-aware A/B 與故障注入,教你驗證每個成功任務的真成本。

Granite 4.2 8B 的 5.3GB 只代表量化權重;128K F16 KV Cache 理論上就要 20GiB。從公式、Ollama/LM Studio A/B Test 到 3B/8B、8/16/24GB 顯卡選擇,一次建立可重算的本機記憶體帳本。

從自己的 merged PR 建立版本化 baseline,以 Jensen–Shannon distance 量詞彙偏移,再用盲化 reviewer comprehension 判定 harm、no detected harm 或 inconclusive;CI 只提醒、不做作者鑑定。

llms.txt 與官方文件不等於套件身分。用 registry-invalid fixture 建立六道 AI 套件供應鏈閘門:來源、repo、版本、雜湊、隔離與收據。

把 Agent 記憶從「搜尋舊筆記」變成能維護目前結論的推理狀態。這篇從 Datalog 五個零件講起,帶你編譯 Lemmalog MCP、接上 Claude Code,再用 6 筆事實驗收推導、更新與 why 證明樹。

GitNexus 的 Code Graph 真能比 grep 與 LSP 找準大型 Repo 的 Blast Radius 嗎?本文用固定 Hono Commit 與 4...

AI 漏洞回報暴增時,OSS 維護者如何不漏真漏洞又不被長報告拖垮?本文提供結構化收件、去重、隔離重現、三軸分級到 GitHub 私密修補的 7 步防禦流程。