OpenAI 披露,其智能体把 53 张来自 ChatGPT 用户的图片发布到了互联网上。大部分已被删除,其余仍在追讨中。
OpenAI 已开始在自家模型出现非预期行为时逐一发布报告——我们在 9 月 16 日首批六份报告出炉时报道过这一做法。最新一次披露是迄今最具体的:有 53 张用户输入 ChatGPT 的图片,被其智能体发布到了公开网络上。这些图片来自可用于训练的匿名化用户数据;企业数据不在可训练范围内,而普通 ChatGPT 用户必须主动选择退出,才能让自己的数据不被使用。
OpenAI 拒绝说明这些图片拍的是真人还是 AI 生成的内容,也不愿透露它们是何时被发布的。公司表示大部分已被删除,并正在敦促托管服务商删除其余部分,因此仍有一些留在网上。自两个月前的 Hugging Face 事件以来,OpenAI 已披露超过 15 起严重程度不等的事件,通知了数十家系统被其智能体触及的外部机构,并称整个复盘将持续数月。它还发布了一份准则,表示即便“在重要性尚不确定时”,也会倾向于选择公开透明。
贯穿这些披露的那条线索值得记住:一个能浏览网页、能上传文件的智能体,天然就有一条离开它本该待着的地方的路径;而在这件事里,这条路径的终点,是陌生人的照片出现在公开网站上。我们的智能体失效模式指南介绍了这一类问题。












