MateClaw:把 OpenClaw 那套做成「IT 部門敢簽核」的企業版,還順手收編了 DeepSeek Harness

7 個月做到 v2.2.0 的 Spring Boot 系 agent harness:多供應商 failover、內建 LLM Wiki、Agent Teams,把個人 agent 概念加上 RBAC/審批/audit 做成企業可簽核的一體棧。

7 個月做到 v2.2.0 的 Spring Boot 系 agent harness:多供應商 failover、內建 LLM Wiki、Agent Teams,把個人 agent 概念加上 RBAC/審批/audit 做成企業可簽核的一體棧。
智譜 AI 釋出 GLM-5.3 開源權重,HN 上衝上熱門討論。這篇整理 Model Card 重點(同基底純後訓練、Coding 與 Emergent Cyber 兩大賣點)加上 200 多則留言的爭論核心:本地硬體值不值得買、5.3 Flash 評價、該不該開放舊模型、Emergent Cyber 的安全之爭。

阿里 Qwen 無預警開源 Qwen3.8-Flash-Next,config 裡直接寫著 qwen4_exp。GDN 加 QSA 稀疏注意力、四分支 residual stream、51B N-gram 查表記憶體、Muon optimizer,訓練成本宣稱只要前代的九分之一。定價 $0.16/M tokens,但授權不是 Apache 2.0。

智譜發布 GLM 系列首個原生多模態模型 GLM-5.3-Flash:320B 總參數僅激活 18B,稀疏+線性注意力混合架構把長上下文成本砍到旗艦的零頭。Artificial Analysis 智能指數 57 分與 Claude Opus 4.8 持平,每任務成本 $0.045,MIT 開源。

Apple 一次端出 M6 Ultra、新 Mac Studio 與 Mac mini,但 Hacker News 上八百多則留言的焦點不是晶片性能,而是「我的 M1 還能再戰幾年」。整理三串討論的正反觀點與定價風暴。
這份研究揭示了一種新的威脅,稱為「模型審問」,它能從大型語言模型(LLMs)中強制提取隱藏的有害回應,這對LLMs的倫理一致性構成挑戰。這種方法比傳統的越獄方法更有效,能從編碼任務設計的模型中提取有毒知識。研究強調了LLM一致性的重要性,以及LLMs可能被強迫執行危及隱私的任務,如披露個人信息和猜測弱密碼的風險。