Mathstodon:探索 AI 與數學研究資料透明度的爭議

Andreas Thom 在 Mathstodon 揭露與 OpenAI 就未公開數學研究資料使用的爭議,本文整理 Hacker News 討論:信任、可驗證性、時間線、署名與企業採用影響。

Andreas Thom 在 Mathstodon 揭露與 OpenAI 就未公開數學研究資料使用的爭議,本文整理 Hacker News 討論:信任、可驗證性、時間線、署名與企業採用影響。

Cognition 推出 SWE-2,FrontierCode 50.0% 緊追 Fable 5.1,便宜 64%。單次 RL 訓全 effort 等級,加上行為大改,Windsurf 老訂戶的心得整理。

HN 對 DeepSeek V4.1 Flash 一面倒好評:架構創新、又快又便宜。但我的策略是先等權重釋出、第三方 ZDR 部署成熟後再上,避開官方與 OpenRouter 拿 prompt 訓練的隱私疑慮。

Anthropic 預訓練研究員 Jacob Coxon 請辭,貼文瀏覽破一億。他接受 WIRED 訪談,談 Hugging Face 攻擊、對齊為什麼還沒解,以及為什麼他認為私人公司不該被信任來跑這場競賽。

6661943.xyz 上的 deepchat 已經改名 deepwork:芋道系企業大模型應用平台雛形,三十多家模型供應商,三十三顆星。現階段就是個起點,這篇記錄研究過程與追蹤點。

Rest of World 報導中國專家兼差訓練 AI,摘要引述加評論:有自研模型才長得出這種產業,台灣想賣腦也沒地方賣;蒸餾就好論直接被打臉。

DeepSeek V4.1 Flash 限時內測登場:新架構、原生多模態,官方稱全面超越 V4 Pro。整理已知資訊、價格調動與 Reddit 第一手實測反應。

Copperhead,一個幫你設計電路板的 AI agent,登上 HN 首頁。重點不是畫板子,是把文件與設計一致變成 build failure。
OpenAI 說內部模型解出了 Navier-Stokes existence and smoothness,Buckmaster 隨即公開聲明指控時序可疑、還被要求拔掉任職 Anthropic 的共同作者。我把 HN 上兩篇合計 1400 多則留言的爭點整理成一篇。

Meta 推出會發信、訂票、結帳的 personal agent Muse。功能是 polished OpenClaw,真正的問題是信任:HN 267 則留言一面倒不想把資料交給 Meta。整理功能、價格、安全架構與社群反應。