大数跨境

如果 ChatGPT 发现用户可能伤人,到底该不该报警?

如果 ChatGPT 发现用户可能伤人,到底该不该报警? Fun AI Everyday
2026-09-12
7
导读:今天想和大家分享和讨论一个“社会新闻”,想借此和大家讨论一下 AI 的产品边界问题。
今天想和大家分享和讨论一个“社会新闻”,想借此和大家讨论一下 AI 的产品边界问题。
OpenAI 最近遇到了一个比 AI 会不会抢工作更难回答的问题:

如果 ChatGPT 发现一个用户可能伤害别人,它到底该不该报警?

9月2日,30名原告在美国加州联邦法院起诉 OpenAI 和 Sam Altman。

这些原告包括今年 2月加拿大 Tumbler Ridge 校园枪击案中的学生、教师和校长。此前,遇难者家属等已经提起7起相关诉讼。

也就是说,围绕同一起事件,OpenAI 现在已经面对至少 37起诉讼

为什么呢?因为枪击案发生前8个月,OpenAI 就已经注意到了这个用户(凶手)。

8个月前,OpenAI 就已经封了他的账号

事情要从 2025年 6月说起。

根据 OpenAI 后来公开的信息,其自动安全系统发现,一个 ChatGPT 账户出现了与暴力活动有关的违规使用。

系统把这个账户交给了人工审核,OpenAI 最终认为它违反使用政策,于是直接封禁了这个账户。

但问题也恰恰出现在这里,OpenAI 当时不仅判断这个账号该不该封,还讨论了另外一个更严重的问题:

要不要通知警方?最终答案是:没有。

OpenAI 后来解释,当时掌握的信息虽然足以违反平台规则,但没有达到公司向执法部门报告所要求的标准:

存在“迫近且可信”的严重现实伤害风险。

所以 OpenAI 做了一个决定:封号,但不报警。大约 8个月后,2026年 2月10日,Tumbler Ridge 发生枪击事件,造成 8人死亡、多人受伤。

枪击案发生后,OpenAI 主动联系了加拿大皇家骑警,并提供了相关账户的信息。

Sam Altman 后来也专门给当地社区写了一封道歉信,其中有一句:

他为 OpenAI 当时没有向执法部门报告这个账户表示歉意。

OpenAI 随后也承认,风险判断并不是永远准确的,并开始调整相关安全措施。

现在的问题变成了:封号够不够?OpenAI 有没有尽到应有的安全责任?

OpenAI 确实发现了风险,确实进行了人工审核,确实封了账号,也确实讨论过是否应该报警。

最终它判断:还没严重到那个程度。恰恰是这个“程度”,成了今天我们要讨论的问题。

ChatGPT 看到的东西,和以前的互联网完全不同

过去 FacebookTwitterYouTube 也经常遇到危险内容,有人公开威胁别人,有人发布暴力视频,有人传播极端内容。平台可以删除、封号,严重的时候通知执法机构。

但 ChatGPT 有一个根本不同的地方:它不是一个公开广场,更像一个私人房间。

一个人可能不会把自己的极端想法发到朋友圈,却会告诉 ChatGPT;他可能不会跟老师、父母、同事说,却愿意凌晨两点跟AI聊几个小时。

而且聊天机器人看到的不是一条孤立的信息,它可能连续几个月看到一个人的变化。

从“我最近非常愤怒”,到“如果有人想伤害别人会怎么样?”再到越来越具体的讨论。

这意味着,未来 ChatGPT、Claude 以及各种 AI 陪伴产品,很可能比身边很多真人更早发现一个用户正在出现危险变化。

于是 AI 公司突然获得了一种过去的软件公司很少拥有的能力:

它可能知道一个人最私密、最危险的想法。

知道之后怎么办,事情就变得麻烦了。最简单的答案当然是:发现危险就报警。

但真正做产品,这几乎不可能。

因为人每天会和 ChatGPT 讨论大量暴力相关内容,有人在写犯罪小说、有人在研究历史、有人刚看完一部恐怖电影、有人只是情绪崩溃,说了一句极端的话。

甚至有人单纯问:“如果一个人想杀掉老板,是不是说明他心理有问题?”

如果出现“枪”、“杀人”、“报复”这些关键词就自动报警,ChatGPT 很快就会变成一个巨大的私人监控系统。

人也不会再把它当成可以放心聊天的工具

还有就是 AI 也会判断错。如果它把一个写剧本的人判断成潜在罪犯怎么办?把一个正在接受心理咨询的人报告给警方怎么办?把一句情绪化的话当成真实计划怎么办?

误报一次,对一个普通人的影响可能非常大,所以 OpenAI 现在采用的标准才会强调:

不是“出现危险内容”就报警,而是判断有没有“迫近且可信”的现实风险。

OpenAI 今年 4月公开介绍了这套机制:一般违规,平台自己处理;风险更高的情况,会进入人工审核。

只有当聊天显示出对他人存在迫近且可信的伤害风险时,才会通知执法部门。

而且 OpenAI 表示,判断时会参考行为和心理健康专家的意见。

这听起来似乎很合理,但 Tumbler Ridge 这件事恰恰证明:

真正困难的从来不是制定标准,而是判断一个具体的人什么时候跨过了那条线。

AI 现在遇到了一个以前属于“人”的问题

以前我们把ChatGPT理解成软件,你问问题,它回答问题。它和 Word、Google Search、Photoshop 一样,本质上都是工具。

工具当然有安全规则,但通常没人会要求 Word 发现你写了一篇危险日记之后主动报警。

可聊天机器人不太一样,因为它越来越像一个长期跟你交流的人。

它知道你之前说过什么,它能理解上下文,它可能连续几个月陪你聊天。

甚至在一些用户那里,它正在承担过去由朋友、老师、咨询师甚至心理医生承担的一部分倾听功能。

于是问题来了:

当一个产品越来越像“人”,社会会不会也开始要求它承担一部分过去只有“人”才承担的责任?

从技术角度看,未来识别风险并不一定是最困难的部分。

模型可以监测一些明显的变化:

危险讨论是不是越来越频繁;有没有出现具体对象;有没有开始讨论时间、地点;有没有从幻想进入现实计划;一个被封禁的用户是不是不断创建新账号。

真正困难的是下一步:识别出来以后怎么办?

我觉得未来大型消费 AI 公司很可能都会出现一套今天普通用户看不到的“后台安全流程”:

模型先识别异常、高风险对话进入人工审核、专业人员判断风险等级、必要时要求更多人工复核。达到一定标准,再决定是否联系家人、平台、学校或者执法部门。

事实上 OpenAI 已经在往这个方向走。

它现在公开表示,高风险案例会接受更深入调查;心理健康和行为专家会参与困难案例的判断;对于重复违规者,也在加强识别和阻止重新注册的能力。

这意味着一个很容易被忽略的变化:

AI 公司的成本以后可能不只是服务器和工程师。

如果几亿人每天都在和 AI 谈工作、感情、家庭、焦虑甚至最危险的念头,那么大型 AI 产品背后可能需要越来越多:

心理健康专家、威胁评估人员、安全审核员、法律团队,以及 24小时工作的人工响应体系。

这已经不是传统软件公司的成本结构了。

这也是 AI 越懂你,越绕不开的问题

过去两年,所有 AI 公司都在追求同一件事情:让 AI 更了解你。

记住你的习惯、知道你的工作、理解你的情绪、拥有长期记忆、陪伴时间越来越长。

这样 AI 才会越来越好用,但这里有一个很少被讨论的另一面:

AI 知道得越多,它承担的责任也可能越大。

一个完全不知道你的搜索框,很难为你的行为负责。

一个陪你聊了一年、记得你过去几个月的状态、能够发现明显异常变化的 AI,就不一样了。

AI 什么时候只是工具,什么时候开始有义务介入现实世界?

真正需要建立的,大概只能是一条很窄的中间线:

保护绝大多数人的隐私,但在极少数高度可信、可能造成严重现实伤害的情况下允许介入。

问题在于,这条线到底画在哪里。

以上,祝你今天开心,健康。

【声明】内容源于网络
0
0
Fun AI Everyday
每天分享一个好玩的AI应用
内容 79
粉丝 0
Fun AI Everyday 每天分享一个好玩的AI应用
总阅读1.6k
粉丝0
内容79