AI Agent 與開發 第 8 頁
所有文章 · 第 8 頁

保留同一份 GGUF,讓 Ollama、llama.cpp 與 LM Studio 跑相同 API、Tool Calling 與效能測例,用五關 scorecard 和 rollback receipt 決定該保留、並存或替換。

從自然語言規格、Teacher 合成與 LoRA 訓練,到四組 holdout、OOD、spec drift、損益平衡與隱私邊界,一篇學會如何評估、版本化並安全整合 Compile by Training 神經函式。

別再只看 sudo 關鍵字。這篇用 44 條完全不執行的合成字串,實作 PreToolUse allow/ask/deny 與影響半徑收據,並把真正高風險測試移進 disposable VM。

RTX 3090 跑 MoE,先別抄 tok/s。從格式、RAM/VRAM、頻寬到同任務 A/B,選出 FreeToken offload、hybrid 或 llama.cpp。

從零外掛 baseline 開始,用同一組五題 smoke eval 逐層檢查規則檔、Skill、Hook 與 MCP;附可複製模板、記分卡與刪除條件。

看到 Prompt Injection 警告,先別怪模型或猜套件遭入侵。本篇用來源指紋、parent span、決策者與 action lineage,教你追出第一個不可信輸入,分清誤報、誤歸因與 Harness 防線。

Spotify Shunt 的「省 90%」其實是三個 bulk-read 案例的 Claude 主上下文估算。本文拆解 Portal/AiKA 前提,示範 exit-2 Read 護欄、worker 證據合約與可停止的同任務 A/B。

把 Claude Code 的「修好了」變成可重跑證據:隔離 Chrome、收集 Console/Network/DOM/截圖與 trace,寫出 assertion,再輸出修補前後的驗收 receipt。

用 human-only baseline 與 AI Shadow Mode 跑一場可重置的 Coding Agent 事故回復演練,量根因證明、錯誤假設、測試污染與人類能力保留。