GLM-5.3-Flash:57 分打平 Opus 4.8、價格十分之一的前沿開源模型

智譜發布 GLM 系列首個原生多模態模型 GLM-5.3-Flash:320B 總參數僅激活 18B,稀疏+線性注意力混合架構把長上下文成本砍到旗艦的零頭。Artificial Analysis 智能指數 57 分與 Claude Opus 4.8 持平,每任務成本 $0.045,MIT 開源。

智譜發布 GLM 系列首個原生多模態模型 GLM-5.3-Flash:320B 總參數僅激活 18B,稀疏+線性注意力混合架構把長上下文成本砍到旗艦的零頭。Artificial Analysis 智能指數 57 分與 Claude Opus 4.8 持平,每任務成本 $0.045,MIT 開源。

NVIDIA 傳出以 130 億美元收購 Hugging Face。Hacker News 上 221 則留言從「Nvidia 對開源一向糟糕」吵到「它最有動機維持開放」,本文整理這筆交易的重點、社群正反論戰,以及最值得關注的後續觀察點。
上週 OpenRouter 出現匿名模型 Ox Alpha,免費、百萬 context、還會看影片。六天後 Z.ai 證實它就是 GLM-5.3-Flash。整理這一週社群怎麼用 tokenizer 指紋、錯誤字串和 stack trace 把它驗明正身,以及 Google 員工帶風向翻車的過程。

Apple 一次端出 M6 Ultra、新 Mac Studio 與 Mac mini,但 Hacker News 上八百多則留言的焦點不是晶片性能,而是「我的 M1 還能再戰幾年」。整理三串討論的正反觀點與定價風暴。
隨著8/1號到來,川普發動的關稅大戰暫時告…

全文翻譯自 The 70% problem: Hard truths…
StreamDiffusion是一個由Akio Kodaira、Chenfeng Xu等開發的創新擴散管道,旨在提升即時互動圖像生成的效能。它的核心功能包括數據處理的流線化、改進的指導機制、GPU利用效率的提高、輸入輸出操作的高效管理、KV-Caches的優化預計算,以及模型加速工具的使用。項目提供了安裝指南、互動式txt2img演示,以及圖像到圖像和文本到圖像的應用示例。此外,還包括了隨機相似性過濾器和殘差CFG(RCFG)等功能,以進一步提高效率。
「Llama 2」模型的範例與配方庫(llama-recipes)提供了關於如何快速開始對特定領域進行細調(fine-tuning)及執行細調模型推論的範例。此庫使用 Hugging Face 轉換版本的模型,以便使用。除了提供示範應用程式外,還展示了在本地、雲端和企業內部運行 Llama 2 的方法。它還包括了關於如何安全地使用 Llama 2 模型的指南,並提醒使用此技術可能帶來的風險。更多資訊可在 GitHub 的 llama-recipes 頁面查看。

Witchfire <巫火>(以下簡稱為巫火),…
英特爾(Intel)、三星(Samsung)和台積電(TSMC)在最近的國際電子器件會議上展示了他們在製造互補式場效應電晶體(CFETs)方面的最新進展。這種技術將nFETs和pFETs堆疊在一起,創造出密度更高的3D結構,被視為摩爾定律的下一階段。英特爾通過從硅片底部接觸晶體管來簡化電路,三星則通過新型乾式蝕刻技術提高製造良率,而台積電則在隔離層的製造上取得創新。這些進步展示了未來高密度、高性能晶片的巨大潛力,預計這些技術將在七到十年後實現商業化。