跳到主要內容

AI · 第 6 頁

Latest AI

最新 AI 文章 · 第 6 頁

共 74 頁

AI 工具與應用
【2026 最新】Claude Sonnet 5.5 vs Opus 5.5 怎麼選?三個真任務測模型與 Effort(Claude Code 教學)

用三種真任務比較 Claude Sonnet 5.5 與 Opus 5.5:固定條件、調整 Effort,依合格成果與完整投入建立自己的 Claude Code 路由表。

最後更新:2026年9月29日
AI 工具與應用
【2026 最新】Claude Projects 記憶隔離怎麼驗?雙專案假資料 5 步檢查

用兩個假資料專案與一般聊天,檢查 Claude 的專案記憶、帳號記憶與舊聊天搜尋,記錄來源並清理測試條目。

最後更新:2026年9月29日
AI 模型與研究
Holo4 開放權重 Agent:61.7% 跑分背後,模型與 Harness 各做了什麼?(2026)

H Company 發布 Holo4 27B 與 35B-A3B:同一模型跨 GUI、程式碼、MCP 與 API。拆解 OSWorld 2.0 的 61.7% 部分得分、41.5% 完整成功率、Harness 影響與兩種權重授權。

最後更新:2026年9月29日
AI 產業與治理
Meta Enterprise Platform:Meta 把 AI Agent 推向企業,CJ Desai 能補上什麼?(2026)

Meta 宣布 Meta Enterprise Platform,並找來 MongoDB 前執行長 CJ Desai。現有 Agent 與 API 能否成為企業可部署、可驗收的產品?

最後更新:2026年9月29日
AI 模型與研究
Fireworks Ember-1:號稱少用 40% token,品質能守住?(2026)

Fireworks 聲稱 Ember-1 保持 Kimi K3 相近品質、少用約 40% token;拆解客戶 A/B、基準測試、相同 API 標價與長流程 Agent 的真實成本。

最後更新:2026年9月29日
AI 模型與研究
Claude Sonnet 5.5 深度解讀:同價升級,70.6% 與 53.03% 怎麼看?(2026)

Claude Sonnet 5.5 與前代同價,Anthropic 宣稱每件任務最多省三成。對照官方 Terminal-Bench 與 Vals AI 外部測試,拆解跑分、fallback 和真正的成本。

最後更新:2026年9月29日
AI Agent 與開發
Cloudflare cf CLI 開放測試:Agent 操作雲端,權限誰把關?(2026)

Cloudflare 推出為 Agent 設計的 cf CLI,宣稱涵蓋逾 3,000 項 API 操作。48% Wrangler 使用來自 Agent 是公司內部統計;本文核對公開功能、遷移承諾與權限邊界。

最後更新:2026年9月29日
AI 工具與應用
【2026 最新】AI Agent Google 試算表權限怎麼查?只讀一份表的 5 步驗收與撤銷

想讓 AI Agent 只讀一份 Google 試算表?先看 OAuth 範圍與帳號,用兩份假表驗收,再逐層撤銷 Connector、Google 授權與檔案分享。

最後更新:2026年9月28日
AI Agent 與開發
【2026 最新】三台本機 AI 怎麼協作?LiteLLM Gateway 路由與 Agent 派工 5 步教學

三台裝置各跑一個本機模型,單一 API 入口和任務派工是兩回事。用 LiteLLM、Planner/Worker 與斷線驗收,從零建出可檢查的三機流程。

最後更新:2026年9月28日