把 Claude 當日記,寫完被警察找上門

雲端 chatbot 不是日記本。機器先掃全部對話,可疑轉真人審查,認定可信就會通報。

圖解版直連備援:https://derek-static.pages.dev/claude-diary-felony.html

事件經過

佛州 Bonita Springs 女子 Carli Michelle Heller,9 月 26 日在 Claude 寫下要掃射警長辦公室。她自稱只是把 Claude 當日記用。

Claude 安全系統標記該筆內容,升級真人審查。審查員認定屬於可信威脅,依緊急政策通報執法單位。警員上門將她拘留,後由警長辦公室情報偵探接手偵辦。

她被依佛州法 836.10「書面暴力威脅」起訴,屬於二級重罪。法條要點:傳送揚言殺傷或槍擊的書面或電子紀錄,而且可能被他人看到,即可成立。

為什麼這次一定會報

Anthropic 政策寫明:若認為有必要防止死亡或重傷,可在有限緊急情況下分享使用者資訊。

脈絡是 OpenAI 才因類似事件挨告。BC 省指控 OpenAI 曾標記槍手對話卻未通報。佛州也在 6 月因 2025 年 FSU 槍擊案提告 OpenAI。站在 Anthropic 立場,報了被罵思想審查,不報出事被罵包庇,兩面不是人。

HN 六派反應

這篇在 HN 拿到 76 分、63 則留言,吵點整理如下。

立場 主張
法律質疑 日記式書寫算威脅嗎。mere statement 不等於 threat,案子可能很弱
隱私派 你在跟 Big Tech 聊天,不是秘密好友。全部對話都會被機器掃過
體諒派 Anthropic 處於兩難,OpenAI 不報才剛被罵翻
誤判派 只看文字分不出 roleplay、測試、安全研究和真心話
開源派 日記和測試走本地 open-weight 模型,就沒有這件事
滑坡派 今天掃日記,明天掃本地檔案。思想罪、Minority Report 既視感

法律細節吵最兇。控方邏輯是員工確實看到了,滿足可能被他人看到。辯方可能打沒有威脅意圖,也不知道會被真人看。也有人指出荒謬之處:違法與否居然取決於服務條款有沒有寫可被審查。

誤判派的例子很實在。有人天天編最邪惡的故事測自家旗標系統,全部寫得像真的。也有人用第一人稱問 LLM,動不動被轉心理諮商線。只看文字,審查員分不出來。

延伸問題

如果日記放在本地,Claude Code 掃檔看到要不要報。掃到沒有授權的檔案呢。以目前的安全投入,只會更可能通報。

同場加映。Microsoft Copilot 影像編輯的人力審查員同樣看得到使用者 prompt、上傳照片和生成結果。名義上只評輸出準不準,但看得到就是看得到。

自保三條線

  • 雲端 LLM 視同公開場合發言。
  • 日記和敏感測試走本地模型或紙本。
  • 送出前自問:這句被截圖登報可以嗎。

資料來源:TechSpot 2026-10-04 報導,HN item 49961057。

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *