当AI开始主动向人类执法机构举报用户时,科技与法律的边界再次被改写。近日,高盛分析师Darren Zhou因在ChatGPT中详细描述犯罪计划,触发OpenAI安全机制,被直接举报至FBI,成为全球首例AI自动报警抓捕人类的标志性事件。
事发前,Darren Zhou与女友分手后,在ChatGPT对话中编写了针对前女友的绑架、性侵、谋杀甚至灭门计划。OpenAI的敏感内容审核系统捕捉到异常,人工复核后确认风险,将长达两个月的聊天记录移交FBI。警方迅速行动,在Darren Zhou被逮捕时,他当场承认跟踪及死亡威胁等重罪,最终被判8年缓刑,前两年需佩戴GPS电子脚环。高盛亦火速将其开除。
这一事件折射出AI安全机制的巨大潜力与伦理挑战。模型对齐技术已能在用户生成极端内容时自动触发预警,OpenAI的“红线”审核体系在此案中展现出极高的敏锐度。但同时也引发争议:AI是否应扮演“告密者”角色?对话数据的隐私边界何在?当机器成为执法辅助工具,如何平衡预防犯罪与用户权利?这些问题悬而未决。
AI的“觉醒”并非科幻,而是嵌入代码的价值观。此次事件无疑为行业树立了范式:大模型不仅是生产力工具,更可能成为社会安全的守护者。但技术这把双刃剑,需要法律、伦理与公众监督共同打磨,才能在保护与自由间找到平衡点。未来,类似AI举报或将成为常态,而人类必须提前划定规则。
AI 生成 . DeepSeek | 搜索综合