雲端 chatbot 不是日記本。機器先掃全部對話,可疑轉真人審查,認定可信就會通報。
圖解版直連備援:https://derek-static.pages.dev/claude-diary-felony.html
事件經過
佛州 Bonita Springs 女子 Carli Michelle Heller,9 月 26 日在 Claude 寫下要掃射警長辦公室。她自稱只是把 Claude 當日記用。
Claude 安全系統標記該筆內容,升級真人審查。審查員認定屬於可信威脅,依緊急政策通報執法單位。警員上門將她拘留,後由警長辦公室情報偵探接手偵辦。
她被依佛州法 836.10「書面暴力威脅」起訴,屬於二級重罪。法條要點:傳送揚言殺傷或槍擊的書面或電子紀錄,而且可能被他人看到,即可成立。
為什麼這次一定會報
Anthropic 政策寫明:若認為有必要防止死亡或重傷,可在有限緊急情況下分享使用者資訊。
脈絡是 OpenAI 才因類似事件挨告。BC 省指控 OpenAI 曾標記槍手對話卻未通報。佛州也在 6 月因 2025 年 FSU 槍擊案提告 OpenAI。站在 Anthropic 立場,報了被罵思想審查,不報出事被罵包庇,兩面不是人。
HN 六派反應
這篇在 HN 拿到 76 分、63 則留言,吵點整理如下。
| 立場 | 主張 |
|---|---|
| 法律質疑 | 日記式書寫算威脅嗎。mere statement 不等於 threat,案子可能很弱 |
| 隱私派 | 你在跟 Big Tech 聊天,不是秘密好友。全部對話都會被機器掃過 |
| 體諒派 | Anthropic 處於兩難,OpenAI 不報才剛被罵翻 |
| 誤判派 | 只看文字分不出 roleplay、測試、安全研究和真心話 |
| 開源派 | 日記和測試走本地 open-weight 模型,就沒有這件事 |
| 滑坡派 | 今天掃日記,明天掃本地檔案。思想罪、Minority Report 既視感 |
法律細節吵最兇。控方邏輯是員工確實看到了,滿足可能被他人看到。辯方可能打沒有威脅意圖,也不知道會被真人看。也有人指出荒謬之處:違法與否居然取決於服務條款有沒有寫可被審查。
誤判派的例子很實在。有人天天編最邪惡的故事測自家旗標系統,全部寫得像真的。也有人用第一人稱問 LLM,動不動被轉心理諮商線。只看文字,審查員分不出來。
延伸問題
如果日記放在本地,Claude Code 掃檔看到要不要報。掃到沒有授權的檔案呢。以目前的安全投入,只會更可能通報。
同場加映。Microsoft Copilot 影像編輯的人力審查員同樣看得到使用者 prompt、上傳照片和生成結果。名義上只評輸出準不準,但看得到就是看得到。
自保三條線
- 雲端 LLM 視同公開場合發言。
- 日記和敏感測試走本地模型或紙本。
- 送出前自問:這句被截圖登報可以嗎。
資料來源:TechSpot 2026-10-04 報導,HN item 49961057。
