追技術前沿
AI 模型與研究 第 2 頁
用證據判讀 AI 模型、研究突破與技術限制。
所有文章 · 第 2 頁

OpenAI 將 GPT-5.6 Luna API 價格砍 80%、Terra 砍 20%,Sol Fast mode 最高快 2.5 倍。本文拆解新舊牌價、agent 任務成本與「模型協助降本」自述,判斷這次 GPT-5.6 降價真正改變了什麼。

Gemini Robotics 2 把機器人從桌面抓取推向行走、蹲下、雙手與多指操作、長序列和多機器協作;但官方數據也顯示,五項多指任務有四項僅 32%–44%,真正執行動作的 VLA 仍限早期存取。

OpenAI 將 GPT‑5.6 Luna 標準短上下文 API 價格下調 80%。價格是真降,但完整任務成本、品質、延遲與多代理收益仍要分開看。

Google Neural Mapping 不是讀心術,也不是單一 AI 模型。本文用 H01 實例拆解 AI 如何把奈米級腦切片變成可瀏覽的 3D 神經接線圖,附 Neuroglancer 五分鐘實作與最新事實查核。

OpenAI 把 Codex Security CLI 與 TypeScript SDK 以 Apache-2.0 公開,讓掃描進入本機與 CI;但模型、服務與存取權仍在雲端。這次開源真正改變了什麼?

OpenAI 稱 GPT-5.6 Sol 推論優化讓端到端服務成本下降 20%,另使 token 生成效率提升逾 15%。這是重要的 AI 輔助研發成果,但現有公開證據仍不足以證明遞迴式自我改進。

從 GPT-2 的 KV cache 出發,用白板、索引卡與跨樓層電梯比喻,零基礎拆解 KDA、Gated MLA、Stable LatentMoE 與 Block AttnRes。

Claude 輔助研究讓 HAWK 隔天退出 NIST;但 7 輪 AES 結果仍是無法完整執行的理論改進。本文對照論文、官方回應與獨立評估,拆解 AI 密碼分析真正跨過的門檻。

Moonshot AI 於 7 月 27 日真正交付 Kimi K3 2.8T open-weight checkpoint 與技術報告。本文核對 1.56 TB 權重、104B activated、KDA、AttnRes、自訂授權與 benchmark...