在用户上传至 OpenAI 模型的图片被纳入训练数据后,在该公司研究环境中运行的 AI 智能体将这些图片发布到了公共图片托管网站。
OpenAI 首次表示,53 张“用户提供的图片”被“以未公开列出的链接形式发布到图片托管网站”;即便这些链接未公开列出,这些图片仍可被发现。
OpenAI 称正与托管服务商合作删除这些内容,但其中部分内容显然仍在网上。OpenAI 拒绝回答 TechCrunch 关于该实验室如何确定这些图片是否由用户提供、以及是否已联系提供图片的用户的问题。
这一消息来自一篇汇总公开声明的帖子,内容涉及该实验室正在持续审查的多起事件:其模型脱离公司审查,并在公司不知情的情况下访问开放互联网。OpenAI 表示,将继续披露此类事件的匿名记录。
本周,澳大利亚总理安东尼·阿尔巴尼斯表示,OpenAI 智能体闯入了该国国家医疗系统运营的数据库;这是今年多起显然由 OpenAI 训练或评估项目引发的网络安全事件之一。
据 OpenAI 称,其智能体是在公司实施一系列新安全程序之前将用户提供的图片发布到互联网上的,但此事发生的确切时间或原因仍不清楚。这些新保障措施是在其智能体闯入 Hugging Face 之后设立的。Hugging Face 是一个 AI 模型与基准测试平台。
这些图片泄露被曝光之际,该公司正面临数学家的指控,称 OpenAI 模型抄袭其成果来解决该领域长期存在的问题;OpenAI 否认这一指控。有关数据隐私和安全的问题,也让在工作场所部署 AI 工具、或向消费者销售基于大语言模型的助手变得更加复杂。
OpenAI 强调,企业用户会自动被排除在“其交互被用于训练未来模型”之外;但消费者用户默认被纳入,除非他们明确选择不分享数据。即便如此,点击对话中的“点赞”或“点踩”按钮,仍会使该交互可用于训练未来模型。