GLM-5.3 開源權重推出:Model Card 重點 + Hacker News 熱議整理
智譜 AI 釋出 GLM-5.3 開源權重,HN 上衝上熱門討論。這篇整理 Model Card 重點(同基底純後訓練、Coding 與 Emergent Cyber 兩大賣點)加上 200 多則留言的爭論核心:本地硬體值不值得買、5.3 Flash 評價、該不該開放舊模型、Emergent Cyber 的安全之爭。
智譜 AI 釋出 GLM-5.3 開源權重,HN 上衝上熱門討論。這篇整理 Model Card 重點(同基底純後訓練、Coding 與 Emergent Cyber 兩大賣點)加上 200 多則留言的爭論核心:本地硬體值不值得買、5.3 Flash 評價、該不該開放舊模型、Emergent Cyber 的安全之爭。

阿里 Qwen 無預警開源 Qwen3.8-Flash-Next,config 裡直接寫著 qwen4_exp。GDN 加 QSA 稀疏注意力、四分支 residual stream、51B N-gram 查表記憶體、Muon optimizer,訓練成本宣稱只要前代的九分之一。定價 $0.16/M tokens,但授權不是 Apache 2.0。

智譜發布 GLM 系列首個原生多模態模型 GLM-5.3-Flash:320B 總參數僅激活 18B,稀疏+線性注意力混合架構把長上下文成本砍到旗艦的零頭。Artificial Analysis 智能指數 57 分與 Claude Opus 4.8 持平,每任務成本 $0.045,MIT 開源。

全文翻譯自 The 70% problem: Hard truths…