AI · 第 41 頁
Latest AI
最新 AI 文章 · 第 41 頁
共 72 頁

Apodex 1.1 這波發布涵蓋完整託管版本(官方模型文件標示 397B)、35B Mini 開放權重與 FrontierAgent。本文拆解長任務設計、作者自報 benchmark,以及「Mini 追上前沿」仍需補上的證據。

Z.ai 正式揭曉 Ox Alpha 就是 GLM-5.3-Flash。從 320B/18B 架構、MIT 權重、1M context、獨立評測到 API 與自架成本,本文拆解它改寫了什麼,又沒有改寫什麼。

M5 Ultra 本機 AI 能靠 512GB 與 1.2TB/s 在桌面跑數千億參數模型嗎?本文深讀 Apple M6/M5 Ultra 發表,核對 M3 Ultra 前例、真實模型尺寸與第三方測試,說清楚容量、頻寬、首 token 與生成速度為何不能混為一談。

OpenAI Jalapeño 首測自報 1.5–1.9 倍峰值每瓦 mixed-token 吞吐、1.7–3.6 倍更低端到端延遲。本文拆解 InferenceX 條件、SemiAnalysis 見證範圍、AgentX 缺口與 NVIDIA 影響。

供應商總帳答不出哪個客戶、功能或重試在燒錢。本文用可重算案例,教你從 Token Trace 建立每 Attempt Ledger,完成預算閘門、共享分攤、發票對帳與 Chargeback。

用固定版本、雙 profile 與 12 題 A/B Test,公平比較 OpenViking 與 MEMORY.md 的召回、新鮮度、來源、Token、延遲、刪除與安全。

Nodeterm 把 Claude Code、Codex、Git Worktree 與狀態通知放進同一張視覺畫布。這篇教學從安裝、任務隔離、Context Link、Kanban 到衝突復原,並用 tmux A/B 驗收判斷它是否適合你。

把 Subagent 回傳當不可信輸入:用固定 JSON、工具白名單、唯讀憑證、Sandbox/Hook 與 hash/Restore Drill,建立可重跑的 Claude 子代理防注入流程。

Thomson LLM 以 Qwen open-weight 模型、不到 10% 的 Thomson Reuters 內容與 4,000 萬美元打造。本文拆開模型與完整系統評測,檢查成本、公開權重、資料護城河與法律 AI 主權仍待證明的邊界。