跳到主要內容

AI · 第 17 頁

Latest AI

最新 AI 文章 · 第 17 頁

共 74 頁

AI 產業與治理
Astra for Law 深度解析:54% 正確率背後,OpenAI 真正賣的是什麼?(2026)

OpenAI 把 GPT‑6 Astra、2.3 億網址法律索引、專用指令與企業工具組成 Astra for Law。本文拆解 54% 正確率的證據邊界,以及它為何代表 AI 競爭正從模型轉向完整工作流。

最後更新:2026年9月19日
AI 模型與研究
Claude 主導 AI 研發 26%?Anthropic 內部指數真正量到什麼(2026)

Anthropic 表示 Claude 已主導 26% 的內部 AI 研發工作。本文拆解自動化指數、30,000 個 Agent、59% 評分一致率與 METR 反例,判讀這項內部量測真正代表什麼。

最後更新:2026年9月19日
AI 模型與研究
【2026 最新】Bonsai 2 27B 完整解析:5.9GB 真能保留 98.2% 能力?(含硬體預算+安裝+12 題驗收)

Bonsai 2 27B 把 27B 語言模型壓到 5.95GB,卻不代表 6GB 裝置就能日用。本文拆解三元權重、98.2% 官方 benchmark、runtime 限制與 12 題驗收法。

最後更新:2026年9月18日
AI Agent 與開發
【2026 最新】ACLIF 教學:把 MCP 工具海編成一條可審計 Agent CLI

ACLIF 把多個 SaaS 工具收斂成共同 CLI grammar。本文固定 1.3.1,實測無憑證 introspection、Salesforce/ServiceNow 唯讀 mock 與 DML metadata,再帶你設計 gateway、MCP 對照 A/B 與故障注入。

最後更新:2026年9月18日
AI Agent 與開發
【2026 最新】Agent CAPA 教學:把 Claude Code 事故變成測試、Hook 與 CI 閘門

從一個 Claude Code 邊界模擬案例開始,實作 Agent CAPA ledger、回歸測試、Hook、required CI 與人工批准,讓錯誤成為可追蹤、可退場的防線。

最後更新:2026年9月18日
AI 模型與研究
【2026 最新】Infinite-Parameter LLM 是什麼?新知寫進權重 vs RAG/長 Prompt

Infinite-Parameter LLM 把即時資料轉成可重用的低秩權重。本文用玩具實驗比較長 Prompt、RAG 與 LoRA,拆解論文證據、限制與部署判斷。

最後更新:2026年9月18日
AI 工具與應用
【2026 最新】Skillsync 教學:Claude Code、Codex、Cursor 跨 Agent 續跑 8 項驗收法

Skillsync 能把 Claude Code、Codex、Cursor session 轉成目標原生格式,但成功匯入不等於可信續跑。本文用 8 項 fidelity matrix、假 canary 與 A/B 流程,驗收訊息、工具、工作樹、權限、秘密與來源完整性。

最後更新:2026年9月18日
AI Agent 與開發
Bend 2 Law 與 Proof:AI 寫程式,機器能把錯誤擋住嗎?(2026)

Bend 2 Law 與 Proof 把 AI 改碼的部分驗收條件交給 checker,但 Proof 只守得住寫進 Law 的邊界。本文以規格漏洞反例與 Bend 2.0.10 重跑,拆解 proof gate、@unsafe、CPU/GPU...

最後更新:2026年9月19日
AI 模型與研究
CUDA Rust:AI 翻譯 24 個 GPU Operator,99.5% 效能代表什麼?(2026)

NVIDIA 宣稱 AI Agent 已把 TileGym 24 個 Operator、約 40 個 GPU Kernel 轉成 CUDA Rust,平均達 cuTile Python...

最後更新:2026年9月18日