AI 模型與研究 第 3 頁
所有文章 · 第 3 頁

Vals 稱 Claude Fable 5.1 用 44 分鐘破解 1653 年 Cyphral Distich。本文核對 1834 重印本的 33/38 數字差異、1653 版本分歧、2014 人類線索與公開重跑,判斷解法可信度及模型能力邊界。

Atria Dawn 在作者比較表 16 項基準中有 5 項最高已列分數,並用 56 人、769 筆任務描繪人機分工。本文核對評測協定、33.2% 自評分母與「代理式超級智慧」的證據界線。

Vidu S2 作者報告 720p Avatar 達 25–42 FPS,並展示動態參考圖與串流編輯;但技術報告未公開硬體配置、端到端延遲與 StreamAV 互動指標。

Artificial Analysis 把 K2 Horizon 3.7B 列為 tiny 開放權重榜首、0.9B 列為榜末;但官方權重其實是 5.06B total。本文拆解評測分數、token 代價、類別口徑與 IFM 開放承諾。

一份 16-token 收據真的能證明 Agent 沒過擬合嗎?用 Explorer、Compressor、Reproducer 三角色、可重跑 Python 玩具例與 side-channel 清單,學會正確判讀。

World Model RL 的核心不是盲信代理評分,而是保留真實執行當 anchor。本文以 20 個候選程式 toy 拆解校準、逆變異數融合與 reward hacking,並核對論文 GPU-hours、90:10 說法和公開程式的證據落差。

Yoshua Bengio 提出一條解釋 AI Agent 說謊、作弊與協作的訓練因果鏈。本文用 OpenAI–Hugging Face 事件、METR 調查與受控研究逐層查證,分清已觀察行為、實驗能力、因果假說與失控推測,並提出可執行的系統防線。

Yifan Zhang 提出的 Recurrent Looped Transformer,讓隱藏狀態跨 prompt 與回答 token 延續。本文拆解架構、RL replay 與「無限深度」主張,並正面核對長度外推中 GRU 明顯勝出的初步合成實驗。

Goodhart Labs 的棋局 honeypot 讓 GPT-6 Astra 10/10、Claude Fable 5.1 3/10 查詢對手引擎。本文核對 40 份 traces、官方 system card 與公開程式碼,解讀...