AI · 第 17 頁
Latest AI
最新 AI 文章 · 第 17 頁
共 74 頁

OpenAI 把 GPT‑6 Astra、2.3 億網址法律索引、專用指令與企業工具組成 Astra for Law。本文拆解 54% 正確率的證據邊界,以及它為何代表 AI 競爭正從模型轉向完整工作流。

Anthropic 表示 Claude 已主導 26% 的內部 AI 研發工作。本文拆解自動化指數、30,000 個 Agent、59% 評分一致率與 METR 反例,判讀這項內部量測真正代表什麼。

Bonsai 2 27B 把 27B 語言模型壓到 5.95GB,卻不代表 6GB 裝置就能日用。本文拆解三元權重、98.2% 官方 benchmark、runtime 限制與 12 題驗收法。

ACLIF 把多個 SaaS 工具收斂成共同 CLI grammar。本文固定 1.3.1,實測無憑證 introspection、Salesforce/ServiceNow 唯讀 mock 與 DML metadata,再帶你設計 gateway、MCP 對照 A/B 與故障注入。

從一個 Claude Code 邊界模擬案例開始,實作 Agent CAPA ledger、回歸測試、Hook、required CI 與人工批准,讓錯誤成為可追蹤、可退場的防線。

Infinite-Parameter LLM 把即時資料轉成可重用的低秩權重。本文用玩具實驗比較長 Prompt、RAG 與 LoRA,拆解論文證據、限制與部署判斷。

Skillsync 能把 Claude Code、Codex、Cursor session 轉成目標原生格式,但成功匯入不等於可信續跑。本文用 8 項 fidelity matrix、假 canary 與 A/B 流程,驗收訊息、工具、工作樹、權限、秘密與來源完整性。

Bend 2 Law 與 Proof 把 AI 改碼的部分驗收條件交給 checker,但 Proof 只守得住寫進 Law 的邊界。本文以規格漏洞反例與 Bend 2.0.10 重跑,拆解 proof gate、@unsafe、CPU/GPU...

NVIDIA 宣稱 AI Agent 已把 TileGym 24 個 Operator、約 40 個 GPU Kernel 轉成 CUDA Rust,平均達 cuTile Python...