跳到主要內容

AI · 第 5 頁

Latest AI

最新 AI 文章 · 第 5 頁

共 74 頁

AI 模型與研究
【2026 最新】GPT-6.1 Sol 在 Codex 值得換嗎?三任務比較 Effort 與完成成本

以三道可驗收的 Codex 任務比較 GPT-6 Sol、GPT-6.1 Sol 與 Effort。固定提示、測試與 repo 起點,計入失敗、人工修正和用量,再決定是否切換。

最後更新:2026年9月30日
AI 工具與應用
OpenAI Dots 常駐代理:主動工作走到哪,權限又留在哪?(2026)

OpenAI Dots 開始有限開放。本文還原常駐代理的工作方式、主動研究的只讀邊界與批准機制,並用官方安全測試判斷哪些成果值得信任。

最後更新:2026年9月30日
AI 模型與研究
GLM-5.3 資安能力:Anthropic 50/410 次漏洞利用,開放權重風險怎麼看?(2026)

Anthropic 測得 GLM-5.3 在隔離 ExploitBench 的 410 次嘗試中有 50 次完整漏洞利用。NIST 也見到開放權重模型的資安能力提升,但兩份評分方法不同;模擬防護數字更不能當成真實入侵成功率。

最後更新:2026年9月30日
AI 模型與研究
Jeff 決策模型:28 毫秒很快,選錯第 27 個選項怎麼辦?(2026)

Jeff 決策模型開放權重,作者報告 M4 Max 每次 28 毫秒;但 v1.0 的長選項漏洞提醒我們,速度與判斷品質要分開驗收。本文拆解 v1.1 修正、基準分數與適用邊界。

最後更新:2026年9月30日
AI 產業與治理
AMD 收購 World Labs 協議:82 億美元買的是模型,還是硬體方向?(2026)

AMD 與 World Labs 簽署約 82 億美元股票收購協議。本文核對原文與 8-K,拆解世界模型、晶片路線圖、開放生態承諾及交易尚待驗證的關鍵。

最後更新:2026年9月30日
AI 模型與研究
GPT-6.1 Sol:與 Astra 只差 1 分,成本真能少近八成?(2026)

GPT-6.1 Sol 的外部評測顯示,綜合指標與 Astra 只差 1 分,單題成本約為 0.72 對 3.26 美元。這篇對照官方資料與測試邊界,教你用合格任務的總成本判斷是否值得換模型。

最後更新:2026年9月30日
AI Agent 與開發
【2026 最新】OpenRig 教學:兩席首跑、Hooks 盤點與卡住復原

從 OpenRig 官方 first-project 兩個 Codex 座位起步:先盤點 setup 與 Hooks 寫入,再用小型 repo 任務核對 queue、checker 和卡住後的復原證據。

最後更新:2026年9月29日
AI 創作與設計
【2026 最新】Claude Design 到 Claude Code:網站設計核准、交接與桌機手機驗收教學

從 Claude Design 核准單頁網站,到 Claude Code 實作與桌機手機截圖驗收;附可複製的核准表、交接施工單和返工格式。

最後更新:2026年9月29日
AI Agent 與開發
【2026 最新】AI Agent DNS 沙盒驗收:HTTP 擋住後,3 步檢查 DNS 出站

HTTP 擋住了,DNS 查詢還會到外部嗎?用自有網域與三張前後對照收據,驗收 Agent 沙盒的解析路徑、日誌和阻擋規則。

最後更新:2026年9月29日