跳到主要內容
← AI

AI Agent 與開發 13

所有文章 · 第 13 頁

AI Agent 與開發
【2026 最新】Accept Header Markdown 怎麼做?WordPress/Cloudflare 6 組 curl 實作

同一網址,瀏覽器拿 HTML、AI Agent 拿 Markdown。從 q-value、406 與 Vary: Accept,到 WordPress 安全閘門、Cloudflare Cache Rules 與 6 組 curl 驗收,一篇完成。

最後更新:2026年8月28日
AI Agent 與開發
【2026 最新】AutoSaddler 是什麼?從失敗 Trace 修 Harness 的最小實驗

AutoSaddler 不是讓 Agent 隨機改 Prompt。這篇實跑官方免憑證 V2 template,帶你讀 events、candidate 與 result,釐清 Train 接受、Dev 排序的真實流程,再加上回歸案例、成本上限與人工核准。

最後更新:2026年8月27日
AI Agent 與開發
【2026 最新】Agent Skill 真的有用嗎?用 NVIDIA SkillEvaluator 做 With/Without A/B Test

Agent Skill 寫得完整,不代表 Agent 真的變好。這篇從免 key Tier 1、四類 Eval cases 到 With/Without 配對 trials,教你用 NVIDIA SkillEvaluator 量 Skill...

最後更新:2026年8月27日
AI Agent 與開發
【2026 最新】GLM-5.3-Flash 實戰:API-first、本機部署與完成成本驗收

GLM-5.3-Flash 每個 token 約啟用 18B,原生權重仍約 306GiB。本篇用合規直連 API 收據、350GB RAM fail-fast 與同 repo 標籤盲評,教你選 API 或本機。

最後更新:2026年8月27日
AI Agent 與開發
【2026 最新】Headlong 持續型 Agent 教學:用 Docker 做兩小時安全評估

用 Docker、獨立可撤銷 key 與假 canary,評估 Headlong 的 runtime wake、trajectory、空轉、成本與停止條件,再決定要不要長駐。

最後更新:2026年8月27日
AI Agent 與開發
【2026 最新】Qwen3.8-Flash-Next 本機怎麼跑?GGUF、N-gram Offload 與四關驗收

6B active 不等於 6B 模型。從 96GiB 記憶體門檻、67.56GiB GGUF、llama.cpp PR 鎖版,到問答、Tool Calling、真實任務四關驗收,一次判斷這顆模型值不值得留在你的本機。

最後更新:2026年8月27日
AI Agent 與開發
【2026 最新】WeMM-Embedding 多模態搜尋教學:用文字找照片、影片與掃描文件

WeMM-Embedding 把文字、照片、影片與掃描頁放進同一向量空間。本文帶你固定 2B 版本、建立 FAISS 索引,並用 12 題 Eval 比較 Hit@k、延遲、記憶體與錯誤類型。

最後更新:2026年8月27日
AI Agent 與開發
【2026 最新】OpenBot 安全實戰:Policy、Audit 與每 Bot 隔離驗收

以固定官方 commit 建立 OpenBot 私有 Lab,設定 enforce Policy,注入私有 IP、路徑越界、受控刪除與人工接管,核對 Audit Trail,也誠實標出共用 Token 等未解缺口。

最後更新:2026年8月26日
AI Agent 與開發
【2026 最新】Voice Agent Eval 怎麼做?12 段錄音測 Barge-in、數字與 Task Success

一份正確逐字稿,仍可能讓 Voice Agent 過早做錯動作。本篇用 12 段錄音,帶你測 first usable text、stable-final delay、Barge-in、關鍵數字、Task Success 與 Partial Transcript 安全閘門。

最後更新:2026年8月26日