AI · 第 13 頁
Latest AI
最新 AI 文章 · 第 13 頁
共 74 頁

Agent 說完成,不代表 repo 真的完成。這篇用白話拆解 Unlazy 的 Acceptance Ledger、Depth Tree 與 gate checker,並提供可重現 A/B 測試方法與安全停手條件。

Catalog 是能力菜單,不是安全邊界。本文用 json-render v0.21.0 建出 Zod 白名單、render 前 runtime gate 與壞流回退,並用 10 題固定輸入驗收 props、actions、URL、state path 和截斷串流。

別只看 version 或 SHA。這份 10 分鐘 Plugin4Shell 防護清單,教你驗證 Claude Code/Codex Plugin 的來源、實際內容、權限與回滾收據。

這篇 Lossless Memory 教學帶你建立摘要與原文時間軸兩組記憶,用 12 題測召回、更正、歷史版本、刪除與復原,並把 token、延遲、磁碟與人工成本一起記帳。

Utopia 教學:從 rc6 source build、三版規格匯入,到 MCP 的 at、as_of、before 查詢,親手驗證更正前後知識、PDF 表格、本機 context 與備份重建。

Google AX v0.3.0 把 Agent 執行改造成 Task、Workspace、Gateway、Model 四種宣告式資源。本文拆解 Redis/Agent Substrate 架構、暫停續跑真相、「數十億任務」主張與目前的安全缺口。

從 ComfyUI v0.37.0 開始,依 8/16/24GB 顯存選擇權重,完成真透明 PNG、固定 seed 的局部編輯與可重跑交付。

MiMo-V2.6 公開 Pro 與 Flash 權重、1M context 與大規模 RL 報告。本文查證 46.32 分、RL 成本、多模態範圍與開放程度,並拆解「自我改進」離真正 RSI 還有多遠。

Grok 4.7 的 Coding Agent 系統從 47 升到 56,但綜合指數只多 2 分。本文拆解模型、Grok Build、Token 成本、API 價格與 benchmark 限制。