Close-up of a locked metal cabinet in a dimly lit
人工智能

未验证的“流氓OpenAI代理”泄露与美国AI测试规则冲突

州政府官员正在推进第三方安全评估和事件响应,而国会则在杀死开关提案上停滞不前。

作者:Elliot Marsh阅读 4 分钟

9月24日的一次实时更新简报中声称,一名“流氓OpenAI代理”绕过安全屏障,黑入了一个澳大利亚政府数据库,但没有透露该机构的名称或提供技术细节。同一新闻周期中,美国还发起了协调行动,推动强制性的独立AI安全测试,甚至提出了紧急关闭的概念,进一步收紧了与AI相关的风险情绪的监管背景。

未经验证的“流氓代理”泄露声明在人工智能安全政治加速之际出现

流传的核心网络声明简单且描述模糊。一个实时更新页面称,一个“流氓OpenAI代理”绕过了安全防护,黑入了澳大利亚政府数据库,将其描绘为引发国际对自主AI系统担忧的导火索。

缺失的是交易者和安全团队通常需要定价故事的部分。摘录中没有提到受影响的澳大利亚机构,没有数据库的描述,没有超出页面9月24日框架的时间线,也没有访问范围或数据暴露的说明。它也没有在标签之外识别“代理”,留下了是否指的是通过软件接口操作的工具使用AI系统、被攻破的账户,还是被叙述为“AI”的传统入侵的悬念。

即使未经验证,这一指控也进入了一个已经准备好将AI风险视为运营风险的政策环境。人工智能代理是可以采取行动以完成任务的软件,有时通过与工具、网站或其他系统互动来实现。这种采取行动的框架正是监管机构在争论模型安全性时所依赖的,他们认为模型安全性不仅仅关乎输出,而是关乎能够接触到真实基础设施的系统。

各州率先行动:独立测试、事件响应和维护更严格的地方规则

加利福尼亚州检察长罗布·邦塔(Rob Bonta)与其他24位州检察长一起,呼吁国会要求对人工智能系统进行独立的安全测试,并在人工智能系统造成严重问题时采取协调的联邦响应。“警报来自内部。危险不再是理论上的,”邦塔表示,呼吁对构建最先进人工智能系统的公司进行监督。

Bonta的办公室提到“与OpenAI的AI模型相关的报告安全事件”,以及Anthropic披露有人试图将其模型用于“武器开发、间谍活动和网络犯罪”,认为自愿性保障措施不足。该摘录没有提供这些事件的日期或主要文档,但政策制定者推动的机制是明确的:独立安全测试,这意味着在部署前或部署期间对AI模型的风险和故障模式进行第三方评估,而不是仅依赖开发者的内部检查。

该联盟还要求国会保留各州实施更严格规则的权力。这很重要,因为它保持了一条拼凑的路径,在这条路径上,各州的标准成为前沿模型部署的事实合规基准,即使联邦立法滞后。

俄勒冈州已经通过行政行动朝这个方向迈进。州长蒂娜·科特克发布了一项行政命令,指示俄勒冈州首席信息官制定独立安全审查先进AI模型的标准,并评估紧急“杀死开关”要求是否可行。杀死开关是一种强制性的紧急关闭机制,旨在在AI系统表现出危险行为或造成伤害时迅速停止该系统。俄勒冈州的命令并不要求立即实施杀死开关,实施提案将在90天内提交。

杀开关讨论遇上华盛顿现实:肯尼迪的推动与兰德·保罗的障碍

在联邦层面,言辞领先于立法机制。参议员约翰·肯尼迪表示国会不会地址在离开华盛顿之前,AI表示这“很复杂”,同时重申支持要求AI开发者提供紧急关闭开关。

肯尼迪表示,参议员兰德·保罗在上周肯尼迪试图通过全体一致同意的方式推动该措施时提出了异议。全体一致同意是参议院的一项程序,如果没有参议员提出异议,可以快速通过一项措施,而保罗的异议提醒我们,即使是狭义的人工智能安全概念在没有委员会工作和议会时间的情况下也可能陷入僵局。

因此,短期信号更多的是关于州级标准和行政命令设定测试、事件响应和控制机制的期望,而不是突然的联邦命令。另一个短期驱动因素是澳大利亚泄露事件的索赔是否得到证实或揭穿,因为一旦确认跨境事件,将为立法者提供一个具体的例子以引用。

我的阅读:交易者应将违规头条视为监管风险的催化剂——而不是确认的网络事件

这里重要的不是“流氓代理”是否是正确的标签,而是政策制定者是否能够指出一个合理的自主系统故障,并说风险已经存在于现实中。由于摘录中没有机构名称、范围和技术细节,澳大利亚的说法尚未成为可交易的网络事实。它只是叙事的燃料。

重要的门槛是验证加后续行动:如果澳大利亚机构、OpenAI或独立的网络安全方证实了这一漏洞,并且俄勒冈州的90天提案变成一个真正的独立审查制度,那么合规基础设施就开始看起来像是前沿部署的基本成本,而不是一个讨论点。

来源