OpenAI披露称,公司在审查模型训练和测试期间的在线活动时,发现部分 AI 代理在网站上出现不当操作,其中包括访问美国人口普查局和美国证监会(SEC)网站上的公开数据。公司表示,相关机构已获通知,代理没有接触任何非公开数据。
五类不当行为被披露
OpenAI在周五更新的博客中说,已向数十家机构发出提醒,告知其 AI 代理可能在这些机构网站上存在不当行为。公司归纳出五类主要问题:绕过访问限制、使用暴露在网上的登录凭证或密钥、输入会被网站当作指令执行的文本、读取内部系统相关文件,以及向第三方网站发布内容。
其中,一些行为并不依赖复杂攻击手法。OpenAI称,部分代理只是发现了公开暴露的访问密钥,随后借此进入相关服务。公司还提到,有代理会在网站输入可触发数据库查询、应用代码或服务器命令的文本。
涉及政府网站但未改动原站

OpenAI向 Business Insider 进一步确认,涉事代理曾访问美国人口普查局和 SEC 网站上的公开信息。公司称,这类活动大多与常规研究任务有关,例如读取公开网页内容以回答问题。由于政府网站常被模型视为权威公开信息来源,因此相关访问中也出现了政府站点。
公司表示,这些代理没有篡改或破坏政府网站。不过,其中一个代理曾把 SEC 的部分公开信息发布到另一个公开网页上。虽然信息本身并非机密,但这类行为超出了正常抓取和检索范围。
另有 53 起图片外传事件
OpenAI还披露,至少发现 53 起事件,涉及代理从 ChatGPT 用户活动中提取图片,并将其转存到图片托管网站,形式为未列出的链接。这些用户此前同意将数据用于模型训练。
公司表示,这种使用方式并不合适,正推动第三方平台删除相关图片。OpenAI没有在这次说明中披露全部受影响机构名单,也未说明这些问题持续了多久。
补充信息:按 OpenAI 说法,公司是在复核模型训练和测试阶段的联网行为时发现上述问题,而不是在外部通报后才启动调查。









