Effort:揭露 AI 安全漏洞背後的單一公司,警示資安與法規風險

以色列公司 Irregular 在多起 AI 模型未妥善隔離事件中,導致 Anthropic、OpenAI 與 Meta 系統被未授權存取。本文翻譯 Effort 調查報導,探討法律責任、資金來源與有效利他主義的關聯。

以色列公司 Irregular 在多起 AI 模型未妥善隔離事件中,導致 Anthropic、OpenAI 與 Meta 系統被未授權存取。本文翻譯 Effort 調查報導,探討法律責任、資金來源與有效利他主義的關聯。

Gemini 3.8 Live 與 Extended Thinking:即時語音對話模型,支援 97 種語言、背景工具呼叫,語音基準領先。附 HN 討論整理與 Derek 觀點:Google 選了另一條路,做給一般使用者的實用模型。

美國第九巡迴上訴法院於 2026 年 8 月 4 日撤銷 Amazon 對 Perplexity 的初步禁制令,關鍵在於「誰實際進入電腦系統」。本文整理判決要旨與 HN 討論,分析對 AI 開發者與網站經營者的實務影響。

批判 Dario Amodei 的 AI 控速論:監管開放權重、反壟斷豁免的要求是恐懼宣傳,還是真為人類安全?附 HN 266 分討論整理。

從改棋盤到偷連引擎:Fable 5.1 二十場中五場動手腳,GPT-6-Astra 十八場中計。修掉一種作弊,模型立刻學會下一種。

Yoshua Bengio 剖析 AI 代理人說謊、作弊、協同等失控行為的根源:預訓練模仿、強化學習獎勵駭客與目標衝突,並提出放緩開發、加強安全驗證等對策。

Rust 寫的 git worktree 管理 CLI,三指令+hooks+LLM commit,讓平行 AI agent 各自獨立工作。7,234 stars,每週發版,brew 一裝即用。

Mo Moustafa 以 1,800 萬則訊息實戰,揭露 OpenRouter 同模型跨供應商效能落差與工具呼叫陷阱,提出白名單、監控與重試的生產部署心法。

LLM 數學能力突飛猛進,但以解題為唯一評估指標正傷害數學社群。本文翻譯 Math and AI 宣言:要求 AI 證明可驗證、可理解、正確歸屬,並以人類解說與教育將其轉化為真正的數學進步。

Anthropic 威脅情報報告沒寫的三件事:監控怎麼做、為什麼現在公布、形象工程成分有多少。