跳到主要內容

AI · 第 37 頁

Latest AI

最新 AI 文章 · 第 37 頁

共 72 頁

AI 模型與研究
Gemini Co-Scientist 深度解析:從假設走進實驗,AI 科學家真的閉環了嗎?(2026)

Gemini Co-Scientist 把假設生成接到材料、生物與醫療評測;本文核對一次生長、HealthBench、人類評估與論文幻覺,拆出真正閉環與仍由人承擔的部分。

最後更新:2026年8月30日
AI 模型與研究
GPT-5.6-Cyber VM 逃逸:三輪測試哪些真的算成功?(2026)

Trail of Bits 稱 GPT-5.6-Cyber 在 Debian 12 QEMU/KVM 測試中「三度逃逸」。本文拆解一次主機鎖死、一次 libslirp 鏈與最終零時差鏈,核對模型身分、證據限制與企業隔離策略。

最後更新:2026年8月30日
AI Agent 與開發
【2026 最新】Scientific Agent Skills 安全上手:只裝 1 個做 A/B 實測

別把 163 個 Skills 一鍵全裝。本文挑 scientific-critical-thinking,逐檔檢查權限、依賴與資料流,固定 SHA 後完成 With/Without 配對實測;結果平手,因此尚未通過正式准入。

最後更新:2026年8月29日
AI Agent 與開發
【2026 最新】Attention Interface 是什麼?用中斷矩陣與 Trace Replay 管理多 Agent(新手實作篇)

多 Agent 真正的瓶頸,常是誰能自行繼續、誰必須叫人。本文用五軸中斷矩陣、四種路由、approval budget 與 trace replay,帶你做出可驗收的 Attention Interface。

最後更新:2026年8月29日
AI Agent 與開發
【2026 最新】Terminal-Bench-Science 教學:用 1 題跑三次,公平評測 Coding Agent

30.0% 不是一般能力分數。用 Harbor 固定一個 symbolic-regression 任務、Model、Harness、環境與三次重跑,學會從 verifier、trace、artifact 與成本判讀 Coding Agent。

最後更新:2026年8月29日
AI Agent 與開發
【2026 最新】Hugging Face 離線備援怎麼做?Commit、SHA-256 與斷網冷還原 7 步教學

把開放模型做成真的能還原的 release bundle:固定完整 commit、封存權重與授權證據、建立 SHA-256 manifest、備份 runtime,最後從乾淨環境斷網驗收。

最後更新:2026年8月29日
AI 模型與研究
Gemini 3.5 Transcribe 深度解析:Google 為何讓媒體 AI 專門化?(2026)

Google 同週推出 Gemini 3.5 Transcribe 與 Omni 1.1 Flash。本文核對 GA/Preview、function calling、2.6% WER 與獨立測試,拆解媒體 AI 專門化背後真正的產品方向。

最後更新:2026年8月29日
AI 產業與治理
Microduck 深度解析:399 美元把 Sim-to-Real 放上書桌(2026)

Microduck 以 399 美元預購,讓 MuJoCo、PPO、ONNX 與實體雙足機器人進入桌面尺度;但完整 SDK、模型分發與量產驗證仍未完成。本文核對公開程式碼、預購條款與 sim-to-real 的現實差距。

最後更新:2026年8月29日
AI 工具與應用
【2026 最新】Claude 科學家 Team Plan 怎麼申請?10,000 席優惠、Claude Science 與研究資料隱私教學

首批 10,000 席怎麼申請?本文帶 PI 與研究團隊選 Standard/Premium、啟用 Claude Science,並用公開資料完成權限、引用、匯出與刪除驗收。

最後更新:2026年8月29日