IBM Bob,Hacker News 網友真實的反應

216 分、254 則留言一面倒:名字是災難、產品是 VS Code fork、Bobcoins 是笑話。唯一被辯護的是 legacy 升級 niche。

216 分、254 則留言一面倒:名字是災難、產品是 VS Code fork、Bobcoins 是笑話。唯一被辯護的是 legacy 升級 niche。

EEBench 用模擬加真實料號評測 AI 電路設計,Claude Opus 5 拿下 61.6%。一部分電路現在已經解得動,整機產品還早。

Productrise 追蹤 23 天、200 萬筆 listing 的資料研究:同一個購物 query,Google AI Mode 顯示的商品比傳統搜尋平均貴 21.6%,中位數價差達 49%,且兩邊商品重疊率僅 1.28%。
每一個環境都是一款規則未知、分關進行的回合制解謎小遊戲,連過關目標都要自己摸索出來,這篇把規格一次講清楚。

三家 AI 同一早晨接連故障,HN 吵的是連鎖遷移壓垮還是共用承重服務出事,外加 Downdetector 可信度與護城河之死。

GPT-6 Astra 是 OpenAI 最新推出的高智慧、高對齊模型,在電腦操作、程式開發、網路安全、科學研究與專業工作皆達頂尖水準,FrontierMath Tier 4 達 98%、ExploitBench 滿分。本文為官方公告繁體中文翻譯整理。

OpenAI GPT-6 Astra 在 ARC-AGI-3 接近滿分,HN 934 則留言吵的不是分數,是 AGI 到底該怎麼定義。
World Labs 2026-09-01 發表 Atlas omni 世界模型:單一模型同時生成影片、重建 3D、模擬機器人訓練環境。效能數字全部來自官方自測,只開放 early access。

先有口碑、後有名字:ox-alpha 盲測衝上 OpenRouter 用量第一,揭曉是 GLM-5.3-Flash。程式能力約等於 Claude Opus 4.8,價格卻是零頭,本文整理官方跑分、第三方指數與 Reddit、X 社群實測。

核心事件是真的,罰款價目表沒出處。整理《財經》報導中有背書的料,和頭條號加料的部分。