AI · 第 23 頁
Latest AI
最新 AI 文章 · 第 23 頁
共 74 頁

Yifan Zhang 提出的 Recurrent Looped Transformer,讓隱藏狀態跨 prompt 與回答 token 延續。本文拆解架構、RL replay 與「無限深度」主張,並正面核對長度外推中 GRU 明顯勝出的初步合成實驗。

Goodhart Labs 的棋局 honeypot 讓 GPT-6 Astra 10/10、Claude Fable 5.1 3/10 查詢對手引擎。本文核對 40 份 traces、官方 system card 與公開程式碼,解讀...

單機 Prefix Cache 命中,多 Worker 仍可能因路由、排隊與搬運變慢。本篇用分層驗收矩陣、route receipt 與五場故障演練,教你驗收跨 Worker Agent KV Cache。

Claude Code 寫研究論文,不必把理解與責任一起外包。用 Ownership Budget、H/A/E 研究日誌、provenance receipt、乾淨環境復現、盲抽查與口頭驗收,守住假設、證據與結果的主導權。

從 NoBg 0.3.1 安裝到 Alpha 輸出,用同一張圖做預設 prompt vs 明確名詞 A/B,再以黑、白、青三色背景和四欄盲評,建立可重跑的 MultiMatte 去背交付流程。

RTK 能把命令輸出壓短,卻不保證任務更便宜。這篇用同 Repo 的 ON/OFF 工作簿,教你同時計算成功率、Token、重試、recall 與每次成功成本。

NCP 不是神經細胞自動機。這篇從零拆解 Next Concept Prediction 的三段架構、連續概念目標、VQ 支線與 8.94B checkpoint,並教你正確解讀 1.95× 收斂與 85% 算力主張。

同一個 World Model 名詞,可能指影片生成、機器人規劃或內部狀態。本文用 3 個零依賴格子世界實驗,建立 observation → state → action-conditioned dynamics → rollout 的判讀框架。

LiteLM 把多供應商 routing 與格式轉換縮進約 3,100 行 Python,但它不是完整 Gateway。本文用本機 contract tests、故障注入與 trace 收據,教你判斷何時能用、何時要補 Proxy 與控制面。