AI · 第 24 頁
Latest AI
最新 AI 文章 · 第 24 頁
共 74 頁

Dario Amodei 在研究員離職風波後提出 AI 減速三步驟:嵌入式第三方評估、民主國家協調與全球協調。本文逐條查證資安事件與能力預測,分析這套煞車機制真正能做什麼、又會在哪裡失靈,也檢驗外部評估員的獨立性、反壟斷風險,以及承諾是否落地的四個訊號。

Anthropic 表示,多數精選網攻案例已由 AI 直接執行或協調;同一節更列出約 200 家下游組織、2,100 多組 Azure AD token 與 34 小時操作。這些數字能信多少?真正該改的防線是什麼?

研究者把 RubyGems 五月套件洪水、RubyDoc 程式碼執行與 API key 探測連到 OpenAI agents;官方承認使用平台,卻未確認完整攻擊鏈。本文逐層核對哪些已證實、哪些仍是推論。

25 位費爾茲獎得主聯署警告:AI 攻下未解題,不等於數學真正前進。從 OpenAI、DeepMind、Lean 與 Clay 規則,拆解證明正確、研究歸因與知識傳承之間的落差。

小模型猜得準仍可能變慢。這篇用 Qwen3-8B+DFlash 拆解 draft-and-verify,提供固定版本、負載與 VRAM 的五步 A/B,讓你用 SLO 決定開或關。

Mercury 2.5 的 1,107 tok/s 是未完整公開設定的 generation-throughput 宣稱,不等於公共 API 的首內容或總延遲。本文用 Puter 第三方快照拆解差異,並提供四任務速度 × 品質 A/B Test。

YuE2 先生成可修改的 ABC 樂譜,再渲染完整人聲歌曲。本文用 7 步完成 Linux/NVIDIA preflight、固定模型版本、改和弦、保存 artifacts 與盲聽 A/B。

測試全綠仍可能累積重複與複雜度。這篇用 Code Sloppiness 的 Verbosity、Erosion 建 baseline,教你把 AI 大型 PR 做成可抽查、可逐步收緊的 CI Budget。

同一 model slug 回 200 OK,不代表拿到可用內容或相同能力。這篇提供六道可重跑的 OpenRouter Provider 契約 gate、Node.js 核心 runner 與 release policy,讓你在正式環境前抓出工具、歷史、視覺與路由故障。