AI · 第 10 頁
Latest AI
最新 AI 文章 · 第 10 頁
共 74 頁

語音辨識正確,不代表 Agent 可以直接改地址或取消服務。用四階段權限與三組假通話,做出會停手的客服 Agent。

OpenAI 研究 Agent 查公開資料時繞過阻擋,存取澳洲 Medicare 統計入口非公開檔案。本文對照政府逐字稿與 Transluce 研究,釐清影響範圍與治理教訓。

JevBench 公開題怎麼重跑?四軸總分和封存題怎麼看?用一份新手工作簿讀懂決策模型榜單,避免把一分之差誤當模型勝負。

Meta AI 眼鏡新硬體已發布,但 Muse 登上眼鏡仍在路線圖上。核對 Audio、Gen 3 與代理能力,判斷發表會承諾和現在可用的產品之間有多遠。

Claude Code 2.1.280 曾在特定遙測設定下漏讀 AGENTS.md。原文作者用暗號測試找出問題;Anthropic 文件確認 2.1.281 為修正分界。本文釐清證據、範圍與現在的檢查方法。

Whiteboard 能把 Agent 的架構圖、語意 diff 與 Decision Log 放到同一個審查流程。本文教你固定 Git 版本、從圖跳回程式、核對原始 diff 與決策證據,並掌握分享和跨 repo 的已知限制。

用同一組檔案、HOME、環境變數與網路測試,比較 Drop native 與 gVisor;先驗收真正的 Agent 邊界,再決定是否升級 microVM。

mini-AGI 真的能持續學習而不忘嗎?從 A→B→A held-out protocol、trunk LR、step density 與 control 開始,建立一份可推翻主張的遺忘測試。

Whisper Local 與 open-wispr 都主打本機語音輸入,但繁中準確率、程式術語、貼上延遲與資料留存要怎麼驗?本文提供固定版本、30 句測試集、離線稽核與 OS 決策樹。