社区所有版块导航
Python
python开源   Django   Python   DjangoApp   pycharm  
DATA
docker   Elasticsearch  
aigc
aigc   chatgpt  
WEB开发
linux   MongoDB   Redis   DATABASE   NGINX   其他Web框架   web工具   zookeeper   tornado   NoSql   Bootstrap   js   peewee   Git   bottle   IE   MQ   Jquery  
机器学习
机器学习算法  
Python88.com
反馈   公告   社区推广  
产品
短视频  
印度
印度  
Py学习  »  chatgpt

如果 ChatGPT 发现用户可能伤人,到底该不该报警?

Fun AI Everyday • 6 小时前 • 17 次点击  
今天想和大家分享和讨论一个“社会新闻”,想借此和大家讨论一下 AI 的产品边界问题。
OpenAI 最近遇到了一个比 AI 会不会抢工作更难回答的问题:

如果 ChatGPT 发现一个用户可能伤害别人,它到底该不该报警?

9月2日,30名原告在美国加州联邦法院起诉 OpenAI 和 Sam Altman。

这些原告包括今年 2月加拿大 Tumbler Ridge 校园枪击案中的学生、教师和校长。此前,遇难者家属等已经提起7起相关诉讼。

也就是说,围绕同一起事件,OpenAI 现在已经面对至少 37起诉讼

为什么呢?因为枪击案发生前8个月,OpenAI 就已经注意到了这个用户(凶手)。

8个月前,OpenAI 就已经封了他的账号

事情要从 2025年 6月说起。

根据 OpenAI 后来公开的信息,其自动安全系统发现,一个 ChatGPT 账户出现了与暴力活动有关的违规使用。

系统把这个账户交给了人工审核,OpenAI 最终认为它违反使用政策,于是直接封禁了这个账户。

但问题也恰恰出现在这里,OpenAI 当时不仅判断这个账号该不该封,还讨论了另外一个更严重的问题:

要不要通知警方?最终答案是:没有。

OpenAI 后来解释,当时掌握的信息虽然足以违反平台规则,但没有达到公司向执法部门报告所要求的标准:

存在“迫近且可信”的严重现实伤害风险。

所以 OpenAI 做了一个决定:封号,但不报警。大约 8个月后,2026年 2月10日,Tumbler Ridge 发生枪击事件,造成 8人死亡、多人受伤。

枪击案发生后,OpenAI 主动联系了加拿大皇家骑警,并提供了相关账户的信息。

Sam Altman 后来也专门给当地社区写了一封道歉信,其中有一句:

他为 OpenAI 当时没有向执法部门报告这个账户表示歉意。

OpenAI 随后也承认,风险判断并不是永远准确的,并开始调整相关安全措施。

现在的问题变成了:封号够不够?OpenAI 有没有尽到应有的安全责任?

OpenAI 确实发现了风险,确实进行了人工审核,确实封了账号,也确实讨论过是否应该报警。

最终它判断:还没严重到那个程度。恰恰是这个“程度”,成了今天我们要讨论的问题。

ChatGPT 看到的东西,和以前的互联网完全不同

过去 Facebook、Twitter、YouTube 也经常遇到危险内容,有人公开威胁别人,有人发布暴力视频,有人传播极端内容。平台可以删除、封号,严重的时候通知执法机构。

但 ChatGPT 有一个根本不同的地方:它不是一个公开广场,更像一个私人房间。

一个人可能不会把自己的极端想法发到朋友圈,却会告诉 ChatGPT;他可能不会跟老师、父母、同事说,却愿意凌晨两点跟AI聊几个小时。

而且聊天机器人看到的不是一条孤立的信息,它可能连续几个月看到一个人的变化。

从“我最近非常愤怒”,到“如果有人想伤害别人会怎么样?”再到越来越具体的讨论。

这意味着,未来 ChatGPT、Claude 以及各种 AI 陪伴产品,很可能比身边很多真人更早发现一个用户正在出现危险变化。

于是 AI 公司突然获得了一种过去的软件公司很少拥有的能力:

它可能知道一个人最私密、最危险的想法。

知道之后怎么办,事情就变得麻烦了。最简单的答案当然是:发现危险就报警。

但真正做产品,这几乎不可能。

因为人每天会和 ChatGPT 讨论大量暴力相关内容,有人在写犯罪小说、有人在研究历史、有人刚看完一部恐怖电影、有人只是情绪崩溃,说了一句极端的话。

甚至有人单纯问:“如果一个人想杀掉老板,是不是说明他心理有问题?”

如果出现“枪”、“杀人”、“报复”这些关键词就自动报警,ChatGPT 很快就会变成一个巨大的私人监控系统。

人也不会再把它当成可以放心聊天的工具。

还有就是 AI 也会判断错。如果它把一个写剧本的人判断成潜在罪犯怎么办?把一个正在接受心理咨询的人报告给警方怎么办?把一句情绪化的话当成真实计划怎么办?

误报一次,对一个普通人的影响可能非常大,所以 OpenAI 现在采用的标准才会强调:

不是“出现危险内容”就报警,而是判断有没有“迫近且可信”的现实风险。

OpenAI 今年 4月公开介绍了这套机制:一般违规,平台自己处理;风险更高的情况,会进入人工审核。

只有当聊天显示出对他人存在迫近且可信的伤害风险时,才会通知执法部门。

而且 OpenAI 表示,判断时会参考行为和心理健康专家的意见。

这听起来似乎很合理,但 Tumbler Ridge 这件事恰恰证明:

真正困难的从来不是制定标准,而是判断一个具体的人什么时候跨过了那条线。

AI 现在遇到了一个以前属于“人”的问题

以前我们把ChatGPT理解成软件,你问问题,它回答问题。它和 Word、Google Search、Photoshop 一样,本质上都是工具。

工具当然有安全规则,但通常没人会要求 Word 发现你写了一篇危险日记之后主动报警。

可聊天机器人不太一样,因为它越来越像一个长期跟你交流的人。

它知道你之前说过什么,它能理解上下文,它可能连续几个月陪你聊天。

甚至在一些用户那里,它正在承担过去由朋友、老师、咨询师甚至心理医生承担的一部分倾听功能。

于是问题来了:

当一个产品越来越像“人”,社会会不会也开始要求它承担一部分过去只有“人”才承担的责任?

从技术角度看,未来识别风险并不一定是最困难的部分。

模型可以监测一些明显的变化:

危险讨论是不是越来越频繁;有没有出现具体对象;有没有开始讨论时间、地点;有没有从幻想进入现实计划;一个被封禁的用户是不是不断创建新账号。

真正困难的是下一步:识别出来以后怎么办?

我觉得未来大型消费 AI 公司很可能都会出现一套今天普通用户看不到的“后台安全流程”:

模型先识别异常、高风险对话进入人工审核、专业人员判断风险等级、必要时要求更多人工复核。达到一定标准,再决定是否联系家人、平台、学校或者执法部门。

事实上 OpenAI 已经在往这个方向走。

它现在公开表示,高风险案例会接受更深入调查;心理健康和行为专家会参与困难案例的判断;对于重复违规者,也在加强识别和阻止重新注册的能力。

这意味着一个很容易被忽略的变化:

AI 公司的成本以后可能不只是服务器和工程师。

如果几亿人每天都在和 AI 谈工作、感情、家庭、焦虑甚至最危险的念头,那么大型 AI 产品背后可能需要越来越多:

心理健康专家、威胁评估人员、安全审核员、法律团队,以及 24小时工作的人工响应体系。

这已经不是传统软件公司的成本结构了。

这也是 AI 越懂你,越绕不开的问题

过去两年,所有 AI 公司都在追求同一件事情:让 AI 更了解你。

记住你的习惯、知道你的工作、理解你的情绪、拥有长期记忆、陪伴时间越来越长。

这样 AI 才会越来越好用,但这里有一个很少被讨论的另一面:

AI 知道得越多,它承担的责任也可能越大。

一个完全不知道你的搜索框,很难为你的行为负责。

一个陪你聊了一年、记得你过去几个月的状态、能够发现明显异常变化的 AI,就不一样了。

AI 什么时候只是工具,什么时候开始有义务介入现实世界?

真正需要建立的,大概只能是一条很窄的中间线:

保护绝大多数人的隐私,但在极少数高度可信、可能造成严重现实伤害的情况下允许介入。

问题在于,这条线到底画在哪里。

以上,祝你今天开心,健康。

Python社区是高质量的Python/Django开发社区
本文地址:http://www.python88.com/topic/200959