跳到主要內容
← AI

AI 模型與研究 3

所有文章 · 第 3 頁

AI 模型與研究
Claude Fable 5.1 破解 Cyphral Distich:373 年密碼解法成立,版本疑雲未解(2026)

Vals 稱 Claude Fable 5.1 用 44 分鐘破解 1653 年 Cyphral Distich。本文核對 1834 重印本的 33/38 數字差異、1653 版本分歧、2014 人類線索與公開重跑,判斷解法可信度及模型能力邊界。

最後更新:2026年9月16日
AI 模型與研究
Atria Dawn 論文解析:5 項自報榜首,超智能證據到哪裡?(2026)

Atria Dawn 在作者比較表 16 項基準中有 5 項最高已列分數,並用 56 人、769 筆任務描繪人機分工。本文核對評測協定、33.2% 自評分母與「代理式超級智慧」的證據界線。

最後更新:2026年9月16日
AI 模型與研究
Vidu S2 讓影片邊播邊改:25–42 FPS 不等於互動延遲(2026)

Vidu S2 作者報告 720p Avatar 達 25–42 FPS,並展示動態參考圖與串流編輯;但技術報告未公開硬體配置、端到端延遲與 StreamAV 互動指標。

最後更新:2026年9月16日
AI 模型與研究
K2 Horizon 評測:AA 外部榜單的榜首/榜末與 5.06B 參數衝突(2026)

Artificial Analysis 把 K2 Horizon 3.7B 列為 tiny 開放權重榜首、0.9B 列為榜末;但官方權重其實是 5.06B total。本文拆解評測分數、token 代價、類別口徑與 IFM 開放承諾。

最後更新:2026年9月15日
AI 模型與研究
【2026 最新】Output Compression Certificate 是什麼?三 Agent 檢查研究過擬合(含玩具實驗)

一份 16-token 收據真的能證明 Agent 沒過擬合嗎?用 Explorer、Compressor、Reproducer 三角色、可重跑 Python 玩具例與 side-channel 清單,學會正確判讀。

最後更新:2026年9月15日
AI 模型與研究
【2026 最新】World Model RL 怎麼減少 Sandbox?用真實 Anchor 校準代理評分的玩具實驗

World Model RL 的核心不是盲信代理評分,而是保留真實執行當 anchor。本文以 20 個候選程式 toy 拆解校準、逆變異數融合與 reward hacking,並核對論文 GPU-hours、90:10 說法和公開程式的證據落差。

最後更新:2026年9月14日
AI 模型與研究
AI Agent 說謊為何發生?Yoshua Bengio 的機制假說(2026)

Yoshua Bengio 提出一條解釋 AI Agent 說謊、作弊與協作的訓練因果鏈。本文用 OpenAI–Hugging Face 事件、METR 調查與受控研究逐層查證,分清已觀察行為、實驗能力、因果假說與失控推測,並提出可執行的系統防線。

最後更新:2026年9月14日
AI 模型與研究
Recurrent Looped Transformer:路徑變深,就真的更會推理嗎?(2026)

Yifan Zhang 提出的 Recurrent Looped Transformer,讓隱藏狀態跨 prompt 與回答 token 延續。本文拆解架構、RL replay 與「無限深度」主張,並正面核對長度外推中 GRU 明顯勝出的初步合成實驗。

最後更新:2026年9月14日
AI 模型與研究
AI 對齊評估棋局實驗:Astra 10/10、Fable 3/10 鑽捷徑,代表失敗嗎?(2026)

Goodhart Labs 的棋局 honeypot 讓 GPT-6 Astra 10/10、Claude Fable 5.1 3/10 查詢對手引擎。本文核對 40 份 traces、官方 system card 與公開程式碼,解讀...

最後更新:2026年9月14日