跳到主要內容

AI · 第 2 頁

Latest AI

最新 AI 文章 · 第 2 頁

共 71 頁

AI 模型與研究
GPT-6.1 Sol:與 Astra 只差 1 分,成本真能少近八成?(2026)

GPT-6.1 Sol 的外部評測顯示,綜合指標與 Astra 只差 1 分,單題成本約為 0.72 對 3.26 美元。這篇對照官方資料與測試邊界,教你用合格任務的總成本判斷是否值得換模型。

最後更新:2026年9月30日
AI Agent 與開發
【2026 最新】OpenRig 教學:兩席首跑、Hooks 盤點與卡住復原

從 OpenRig 官方 first-project 兩個 Codex 座位起步:先盤點 setup 與 Hooks 寫入,再用小型 repo 任務核對 queue、checker 和卡住後的復原證據。

最後更新:2026年9月29日
AI 創作與設計
【2026 最新】Claude Design 到 Claude Code:網站設計核准、交接與桌機手機驗收教學

從 Claude Design 核准單頁網站,到 Claude Code 實作與桌機手機截圖驗收;附可複製的核准表、交接施工單和返工格式。

最後更新:2026年9月29日
AI Agent 與開發
【2026 最新】AI Agent DNS 沙盒驗收:HTTP 擋住後,3 步檢查 DNS 出站

HTTP 擋住了,DNS 查詢還會到外部嗎?用自有網域與三張前後對照收據,驗收 Agent 沙盒的解析路徑、日誌和阻擋規則。

最後更新:2026年9月29日
AI 工具與應用
【2026 最新】Claude Sonnet 5.5 vs Opus 5.5 怎麼選?三個真任務測模型與 Effort(Claude Code 教學)

用三種真任務比較 Claude Sonnet 5.5 與 Opus 5.5:固定條件、調整 Effort,依合格成果與完整投入建立自己的 Claude Code 路由表。

最後更新:2026年9月29日
AI 工具與應用
【2026 最新】Claude Projects 記憶隔離怎麼驗?雙專案假資料 5 步檢查

用兩個假資料專案與一般聊天,檢查 Claude 的專案記憶、帳號記憶與舊聊天搜尋,記錄來源並清理測試條目。

最後更新:2026年9月29日
AI 模型與研究
Holo4 開放權重 Agent:61.7% 跑分背後,模型與 Harness 各做了什麼?(2026)

H Company 發布 Holo4 27B 與 35B-A3B:同一模型跨 GUI、程式碼、MCP 與 API。拆解 OSWorld 2.0 的 61.7% 部分得分、41.5% 完整成功率、Harness 影響與兩種權重授權。

最後更新:2026年9月29日
AI 產業與治理
Meta Enterprise Platform:Meta 把 AI Agent 推向企業,CJ Desai 能補上什麼?(2026)

Meta 宣布 Meta Enterprise Platform,並找來 MongoDB 前執行長 CJ Desai。現有 Agent 與 API 能否成為企業可部署、可驗收的產品?

最後更新:2026年9月29日
AI 模型與研究
Fireworks Ember-1:號稱少用 40% token,品質能守住?(2026)

Fireworks 聲稱 Ember-1 保持 Kimi K3 相近品質、少用約 40% token;拆解客戶 A/B、基準測試、相同 API 標價與長流程 Agent 的真實成本。

最後更新:2026年9月29日