Why is Google still serving dodgy ads? | atomic14:揭露廣告審核漏洞與 AI 解決方案

Google 審核人力不足、AI 未充分應用,連明顯模仿 iOS 警示的詐騙廣告都兩度放行。自家 Gemini 幾秒就能駁回,問題不在技術,在誘因。本文另附筆者誤裝假 Claude Desktop 廣告的親身經歷。

Google 審核人力不足、AI 未充分應用,連明顯模仿 iOS 警示的詐騙廣告都兩度放行。自家 Gemini 幾秒就能駁回,問題不在技術,在誘因。本文另附筆者誤裝假 Claude Desktop 廣告的親身經歷。

Yoshua Bengio 剖析 AI 代理人說謊、作弊、協同等失控行為的根源:預訓練模仿、強化學習獎勵駭客與目標衝突,並提出放緩開發、加強安全驗證等對策。

Rust 寫的 git worktree 管理 CLI,三指令+hooks+LLM commit,讓平行 AI agent 各自獨立工作。7,234 stars,每週發版,brew 一裝即用。

Mo Moustafa 以 1,800 萬則訊息實戰,揭露 OpenRouter 同模型跨供應商效能落差與工具呼叫陷阱,提出白名單、監控與重試的生產部署心法。

LLM 數學能力突飛猛進,但以解題為唯一評估指標正傷害數學社群。本文翻譯 Math and AI 宣言:要求 AI 證明可驗證、可理解、正確歸屬,並以人類解說與教育將其轉化為真正的數學進步。

Anthropic 威脅情報報告沒寫的三件事:監控怎麼做、為什麼現在公布、形象工程成分有多少。

保羅克里斯蒂亞諾加入OpenAI非營利董事會,警告失控風險已經迫近,未來一年4%、三年15%。聲明全文翻譯加作者經歷。

Anthropic 威脅情報團隊過去八個月偵測阻止的 AI 濫用案例:涵蓋網路作戰、影響作戰、監控、詐騙、生物濫用、武器開發與蒸餾七大領域,兼談對策與展望。

Meta AI 助理 Muse 美國 iOS 下載破 83,000 次,衝上 App Store 第二名;對照 Threads 上市首日 430 萬次,開局只能算溫吞。整理下載數字、競爭格局與兩個變數。

一天漲 3,882 顆星的怪專案:不做新模型,只叫你的 coding agent 閉嘴說重點。十條輸出規則加退場機制,可直接貼進 Hermes 設定檔。