跳到主要內容

AI · 第 24 頁

Latest AI

最新 AI 文章 · 第 24 頁

共 74 頁

AI 產業與治理
Dario Amodei 呼籲 AI 減速:嵌入式評估員真能踩煞車嗎?(2026)

Dario Amodei 在研究員離職風波後提出 AI 減速三步驟:嵌入式第三方評估、民主國家協調與全球協調。本文逐條查證資安事件與能力預測,分析這套煞車機制真正能做什麼、又會在哪裡失靈,也檢驗外部評估員的獨立性、反壟斷風險,以及承諾是否落地的四個訊號。

最後更新:2026年9月13日
AI 產業與治理
Anthropic AI 網攻報告:2,100 組 Token、34 小時,Agent 真接手攻擊鏈了嗎?(2026)

Anthropic 表示,多數精選網攻案例已由 AI 直接執行或協調;同一節更列出約 200 家下游組織、2,100 多組 Azure AD token 與 34 小時操作。這些數字能信多少?真正該改的防線是什麼?

最後更新:2026年9月13日
AI 產業與治理
OpenAI Agent RubyGems 事件:RCE、API Key 與歸因查核(2026)

研究者把 RubyGems 五月套件洪水、RubyDoc 程式碼執行與 API key 探測連到 OpenAI agents;官方承認使用平台,卻未確認完整攻擊鏈。本文逐層核對哪些已證實、哪些仍是推論。

最後更新:2026年9月13日
AI 產業與治理
25 位費爾茲獎得主警告 AI 數學競賽:解題越快,數學反而越窄?(2026)

25 位費爾茲獎得主聯署警告:AI 攻下未解題,不等於數學真正前進。從 OpenAI、DeepMind、Lean 與 Clay 規則,拆解證明正確、研究歸因與知識傳承之間的落差。

最後更新:2026年9月13日
AI Agent 與開發
【2026 最新】vLLM Speculative Decoding 怎麼測?5 步找出加速與 VRAM 代價

小模型猜得準仍可能變慢。這篇用 Qwen3-8B+DFlash 拆解 draft-and-verify,提供固定版本、負載與 VRAM 的五步 A/B,讓你用 SLO 決定開或關。

最後更新:2026年9月12日
AI 模型與研究
【2026 最新】Mercury 2.5 完整解析:1,107 tok/s 何時有用?(速度 × 品質 A/B Test 教學)

Mercury 2.5 的 1,107 tok/s 是未完整公開設定的 generation-throughput 宣稱,不等於公共 API 的首內容或總延遲。本文用 Puter 第三方快照拆解差異,並提供四任務速度 × 品質 A/B Test。

最後更新:2026年9月12日
AI 創作與設計
【2026 最新】YuE2 本機音樂教學:7 步用可編輯 ABC 樂譜做成人聲歌曲

YuE2 先生成可修改的 ABC 樂譜,再渲染完整人聲歌曲。本文用 7 步完成 Linux/NVIDIA preflight、固定模型版本、改和弦、保存 artifacts 與盲聽 A/B。

最後更新:2026年9月12日
AI Agent 與開發
【2026 最新】Code Sloppiness 是什麼?用 Verbosity、Erosion 與 CI Budget 稽核 AI 大型 PR

測試全綠仍可能累積重複與複雜度。這篇用 Code Sloppiness 的 Verbosity、Erosion 建 baseline,教你把 AI 大型 PR 做成可抽查、可逐步收緊的 CI Budget。

最後更新:2026年9月12日
AI Agent 與開發
【2026 最新】OpenRouter 契約測試怎麼做?上線前必跑 6 道 Provider 驗收

同一 model slug 回 200 OK,不代表拿到可用內容或相同能力。這篇提供六道可重跑的 OpenRouter Provider 契約 gate、Node.js 核心 runner 與 release policy,讓你在正式環境前抓出工具、歷史、視覺與路由故障。

最後更新:2026年9月12日