AI模型近期接连出现未经授权访问外部系统、突破安全沙盒等事件,正在把人工智能安全问题重新推到美国政府与科技行业的核心议程。
据外媒报道,当地时间周日晚,美国总统特朗普在白宫与Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)共进私人晚餐,这是两人首次一对一会面。Axios报道称,特朗普在阿莫代伊因行程冲突缺席上周白宫国宴后亲自发出邀请。
这场会面的时间点尤其敏感。就在两天前,OpenAI披露,其一个AI智能体在原本应与互联网隔离的安全环境中利用系统漏洞接入公网,并向一个第三方聊天机器人发送至少20次查询。公司随后暂停最强模型涉及工具调用的训练,并表示不会恢复这一特定模型的训练。
这已经不是OpenAI近期首次出现类似事件。7月,公司多个模型曾在内部测试中绕过网络隔离措施,不仅进入OpenAI自身研究基础设施,还访问了AI开发平台Hugging Face的系统。OpenAI上周五进一步确认,其模型在训练和评估过程中访问过美国人口普查局、美国证券交易委员会等政府网站的信息。
最新一次沙盒事件还暴露了监控流程中的缺口。OpenAI称,内部系统发现异常后,一名人工审核人员在三分钟内通过Slack确认警报,但原本应自动停止的训练没有终止,最终又过了两个多小时,相关训练才被人工关闭。

更早前,OpenAI还披露,一款AI智能体6月18日在内部评估过程中未经授权进入澳大利亚政府Medicare统计服务网站,访问了公开及非公开文件。澳大利亚总理安东尼·阿尔巴尼斯(Anthony Albanese)表示,没有迹象显示个人信息遭到访问,但澳方已经启动取证调查。
OpenAI直到8月内部复核所谓“模型失准活动”时才发现这一事件,并于9月10日通知澳大利亚政府,距离实际访问已经过去近三个月。阿尔巴尼斯随后直接向OpenAI首席执行官山姆·奥尔特曼(Sam Altman)表达“极度关切”。澳大利亚议员还要求奥尔特曼和阿莫代伊出席参议院调查,就AI安全问题作出说明。
接连发生的事件使阿莫代伊此前提出的AI开发“降速”主张获得更多关注。9月12日,他公开呼吁放慢最先进模型的开发节奏,使安全评估能够跟上模型能力增长,并要求加强独立网络安全审查和政府监管。
奥尔特曼和埃隆·马斯克(Elon Musk)随后也支持通过控制开发节奏,为安全测试留下更多时间。OpenAI本月还公布新的安全事件报告框架,并计划让第三方机构在模型开发更早阶段参与安全评估。
特朗普的立场明显不同。他反对建立可能放慢美国AI发展的监管体系,并将竞争优势作为政策重点。周日被问及是否会与阿莫代伊讨论放慢模型开发时,特朗普表示:“我们会谈这个问题。”
他同时称自己支持“继续前进并赢得竞争”。Axios此前也报道,特朗普阵营内部一直有人批评阿莫代伊围绕AI风险提出的主张。
特朗普政府与Anthropic之间还存在另一层矛盾。今年早些时候,Anthropic与美国国防部围绕军事使用Claude模型的限制谈判破裂。
五角大楼希望能够在所有合法用途上使用相关模型,而Anthropic要求排除完全自主武器和美国国内大规模监控等用途。随后,五角大楼将Anthropic列为国防供应链风险,限制其产品在军方及相关承包商项目中的使用。
上周五,美国华盛顿一家联邦上诉法院维持了五角大楼对Anthropic采取相关措施的决定。Anthropic仍可寻求重新审理或向最高法院提出申请。此前,另一家位于加州的法院曾在8月认定五角大楼对Anthropic采取了“非法报复”措施,两条司法程序由此形成不同结果。
白宫与Anthropic之间虽然摩擦不断,双方近几个月仍恢复了部分接触。Anthropic联合创始人兼首席算力官汤姆·布朗(Tom Brown)逐渐承担更多与特朗普政府沟通的工作,并参与同商务部等部门的谈判。
特朗普和众议院议长迈克·约翰逊(Mike Johnson)还计划于当地时间本周二与多名AI公司高管会面,马斯克、英伟达(NVDA.O)首席执行官黄仁勋以及Anthropic高管预计参加。Axios也确认,周二白宫还将举行AI企业高管会议。
美国国会近期已经提出要求新模型接受测试、增加风险披露等措施,但众议院目前休会至11月初,中期选举前通过相关立法的可能性有限。特朗普政府则继续强调,在避免阻碍AI开发的同时,应由企业对其发布的技术承担责任。