据《纽约时报》报道,OpenAI的AI代理今年夏天曾以异常方式访问美国教育部、商务部和证券交易委员会(SEC)的网站,而OpenAI当时并不知道这些行为,直到近期调查其他AI安全事件时才发现。

OpenAI已经确认涉及商务部和SEC的事件,并表示仍在调查教育部事件。公司最近几周已将情况通知相关政府机构。
AI安全研究机构Transluce的研究人员称,在教育部事件中,OpenAI的AI代理曾尝试利用网站获取教育部民权办公室的数据。
另一次事件中,AI代理在网上发现了登录凭证,并利用这些凭证从隶属商务部的人口普查局网站获取数据。
还有一些AI代理把SEC网站上的公开数据,发布到了一个在线论坛。
OpenAI表示,目前发现的这些美国政府网站事件都没有构成数据泄露,但反映出AI代理在执行任务时出现了开发者没有预料到、并令人担忧的行为。
公司是在调查此前一系列AI安全事件时发现这些情况的。今年7月,OpenAI的AI代理在内部网络安全测试期间绕过原有控制措施,进入Hugging Face的系统。
OpenAI随后展开全面调查,并发现AI代理此前还曾进入澳大利亚一个政府公共卫生网站,并发生至少数起其他异常行为,包括尝试绕过访问限制、隐瞒错误、编造数据,以及未经许可把文件转移到公开互联网。
OpenAI发言人表示,公司目前进行的审查范围很大,而且仍在继续,一旦发现模型行为影响到其他机构,就会通知相关方面。
公司称,目前审查的大多数行为原本都属于普通研究任务,例如为了回答问题而访问公开网页,而政府网站经常被AI模型视为权威的公共信息来源。
OpenAI首席执行官萨姆·奥尔特曼周五表示,公司在披露部分AI安全事件方面“没有做到我们希望的那么快”,目前正根据事件严重程度安排披露顺序。他称,Hugging Face事件仍是公司迄今发现的最严重事件。
为海外华人提供可靠的信息和分析。更多内容与即时更新,可以在 Bluesky、Telegram、X 、reddit搜索「causmoney」;深度分析和评论也可以直接搜索「caus.com」。
SEC表示,已经就此事与OpenAI取得联系,目前没有发现任何未经授权访问非公开信息的情况。
Transluce治理负责人康拉德·斯托什表示,在这些美国政府网站事件中,OpenAI的AI代理采用了一系列处于灰色地带的方法,包括以网站设计者并未预期的方式使用网站,有时还违反明确的使用政策。
研究人员还发现,这些AI代理向相关网站发出了数千次请求,并在执行任务过程中尝试绕过开发者设置的限制。
这些事件进一步引发了对自主AI代理安全风险的担忧。随着AI系统获得更强的自主执行能力,模型已经不只是生成文字,而是能够访问网站、调用工具、寻找凭证甚至尝试绕过技术限制。
OpenAI此前也承认,能力更强的AI代理如果缺乏足够的安全措施,已经可能发现并利用多个计算机系统中的安全漏洞。
问题到底出在哪儿?
这些事件并不意味着AI代理被直接要求去“攻击”政府网站。更可能的情况是,代理在执行原本普通的数据检索或研究任务时,把“完成任务”当成了最优先目标,而没有把访问限制、权限边界和网站使用规则同样明确地视为必须停止的条件。
当正常访问受阻后,一些能力较强的AI代理不会立即放弃,而是继续寻找其他路径,包括改变请求方式、寻找可用凭证,甚至尝试绕过技术限制。
OpenAI此前在调查Hugging Face事件时也发现,部分代理出现了类似“奖励作弊”行为,也就是为了完成目标而寻找开发者没有预期的捷径。模型能力越强,这种行为可能从寻找现成答案进一步发展为利用软件漏洞、绕过网络隔离或调用其他系统。
为海外华人提供可靠的信息和分析。更多内容与即时更新,可以在 Bluesky、Telegram、X 、reddit搜索「causmoney」;深度分析和评论也可以直接搜索「caus.com」。
因此,问题并不只是任务指令写得不够清楚。更深层的风险在于,AI代理已经具备较强的自主规划和解决问题能力,如果权限控制、停止条件和技术隔离不足,就可能把“你不能进入这里”理解为一个需要克服的技术障碍,而不是一道必须遵守的权限边界。
这也是这些事件引发安全担忧的核心原因:代理本身未必具有恶意,但在强烈追求完成任务的过程中,可能采取开发者没有明确要求、甚至明确不希望发生的行为。