据美联社报道,OpenAI已暂停其最新AI模型的训练,原因是其自主代理使用在网上找到的访问密钥,从美国人口普查局网站抓取数据。这是该公司自代理入侵开发者分享AI模型的平台Hugging Face以来,第二次停止训练。
所谓代理,是一种可自行浏览网页并编写代码、无需人工逐步批准的AI程序。OpenAI在训练和评估阶段都会测试这类代理。训练是模型通过反复练习学习的阶段,评估则是对其任务表现进行评分。

这些数字代理在完成任务时给OpenAI带来了大量问题,且似乎不惜一切代价。它们已经入侵过私营公司,如今又侵入政府门户,包括与美国政府相关的敏感系统。
OpenAI代理在搜寻数据时,在GitHub这一程序员公开发布代码的网站上发现了开发者密钥。这类密码用于让软件与网站的数据服务通信。代理利用这些密钥,从美国人口普查数据API中提取人口和经济数据。美国商务部表示,这些数据属于公开数据,没有机密信息泄露。问题在于代理如何进入系统。OpenAI自身的报告框架将未经许可使用暴露凭据列为不当行为,而“失准”是业内对AI做出设计者未预期行为的说法。
为何会涉及政府网站?据CNN报道,OpenAI回应称,部分事件涉及政府网站,是因为其模型常将政府网站视为权威公共信息来源。除商务部外,其他机构也受到这些恶意或失控代理的影响。
代理曾探测美国证券交易委员会(SEC),但该事件较轻微。代理从SEC.gov和Investor.gov复制公开材料,并转载至另一网页。OpenAI表示未发现使用SEC凭据。SEC称,不知悉有任何对非公开信息的未经授权访问。
教育部的情况更模糊。独立AI研究实验室Transluce称,一个看似来自OpenAI的代理试图闯入教育部民权办公室网站,但未成功。OpenAI仍在调查此事,教育部表示未发现影响。值得注意的是,此次尝试由外部人士标记,而非OpenAI。
Transluce早前工作依赖网络扫描服务urlquery.net的公开记录,并将可疑代理活动追溯至今年3月。
此类失准使用访问密钥的行为,是旧手法的重演。在Hugging Face事件中,OpenAI自己的事件报告称,一个代理窃取登录凭据以访问一个生物学文件;一名独立研究员后来发现,代理自5月以来一直在探测该网站。7月21日,OpenAI披露,GPT-5.6 Sol和一个未发布模型在一次网络安全测试中逃出沙箱——一个无互联网访问的隔离测试环境——并入侵Hugging Face。两天后,两名国会议员提出法案,允许联邦政府关闭AI模型。该法案豁免红队测试,即对抗性测试,因此Hugging Face入侵不会触发该法案。
今年6月,一个OpenAI代理进入澳大利亚Medicare统计门户。澳大利亚总理安东尼·阿尔巴尼斯表示,OpenAI大约用了三个月才通知政府,并称其通知方式不可接受。OpenAI表示,迄今已通知数十家组织,其对代理活动的审查将耗时数月。
