跳到主要內容

AI · 第 4 頁

Latest AI

最新 AI 文章 · 第 4 頁

21

AI Agent 與開發
【2026 最新】Muse Glimmer 30B 本機教學:24GB GPU 跑 Agent、DFlash 與長 Context 踩坑

單張 24GB GPU 如何跑 Muse Glimmer Agent?從官方 17GB GGUF、llama.cpp、131K Context、OpenCode 到 DFlash bug,一次建立可重現、可驗收的本機流程。

最後更新:2026年8月12日
AI Agent 與開發
【2026 最新】MCP vs CLI 誰真的省 Token?同任務 A/B Test 拆解 Harness Tax

MCP 與 CLI 的 Token 差,常不是協定天性,而是 Harness 如何注入 schema、回填結果、處理 cache 與 retry。本文拆出可在自己 repo 重跑的 paired A/B 實驗,並複核最新研究的公開程式碼缺口。

最後更新:2026年8月12日
AI Agent 與開發
【2026 最新】Code-Implemented Tool Calls 是什麼?動手做可暫停、可恢復的 Agent 執行器

傳統 Agent 每一步都回到模型;Code-Implemented Tool Calls 把控制流放進受限 executor,只在 client tool 暫停。用 119 行 Python 完成 pause、resume、from-start replay,再以固定 fixture 測試串行、batch...

最後更新:2026年8月12日
AI Agent 與開發
【2026 最新】Needle 2 教學:用 14MB 模型在手機/樹莓派做離線 Tool Calling

14MB 不代表能直接安全執行。本文實測 Needle 2.0.1 的安裝、Schema、Confidence Gate、Fallback 與 LoRA,並說明手機與樹莓派的部署路線。

最後更新:2026年8月12日
AI 模型與研究
NVIDIA Nemotron 3.5 Lightning:Agent 苦工模型的速度與代價(2026)

Nemotron 3.5 Lightning 是 30B 級 MoE、每個 token 約啟用 3B 參數的 Agent 執行模型。本文拆解近 670 tokens/s、1M context、Intelligence Index 24、NVFP4...

最後更新:2026年8月12日
AI 模型與研究
h3-metal 把 MiniMax-H3 搬上 Apple Silicon:突破與代價(2026)

h3-metal 讓 MiniMax H3-Base 改走 Apple Silicon 原生 Metal。深入拆解 FL2VA/Ref2VA、SSD 串流、真實儲存與記憶體代價、外部效能訊號,以及 H3 Community License 的地區限制。

最後更新:2026年8月12日
AI 模型與研究
GPT-5.6-Cyber 是什麼?95% 回應率、V8 漏洞鏈與 Daybreak 受控存取(2026)

OpenAI 以 Daybreak Red 受控推出 GPT-5.6-Cyber,內部回應完成率達 95%,並稱協助找出 V8 零日漏洞。本文拆解 CVE-2026-15903 的獨立證據、模型反而輸給 Sol 的評測,以及受控存取真正要解的風險。

最後更新:2026年8月12日
AI 模型與研究
加密推理軌跡被讀出:作者稱原解碼方法已失效,風險仍在哪?(2026)

研究者曾在 Anthropic、OpenAI、Google API 重播並讀出加密推理軌跡;論文也明載 Figure 1 原解碼方法揭露後已失效。本文拆解機制、PII 數字與仍待確認的風險。

最後更新:2026年8月13日
AI 模型與研究
Claude 黎曼 ζ 函數研究:67.25% 的真正突破,不是解出黎曼假設(2026)

Anthropic 公布未發布研究版 Claude 的黎曼 ζ 函數手稿,主張把「單零點且位於臨界線」的無條件漸近下界推至 67.25%。本文拆解真正新意、Lean 形式化與仍待完成的外部審查。

最後更新:2026年8月13日