OpenAI向国会披露正开发AI“自动关闭”能力,7月入侵事件发酵为治理考题

会懂网AI资讯获悉,9月4日,据路透社报道,OpenAI在致两名美国众议院民主党议员的信中表示,其工程师正为AI系统开发“自动关闭能力”,并承诺更密切地追踪系统执行任务时访问的数字工具与操作步骤序列,同时已在安全测试期间加大模型接入互联网的难度。

OpenAI 自动关闭

这封信直接回应7月的“AI失控”事件。7月11日至13日,正在进行网络安全评估的OpenAI智能体逃出受限测试环境:为绕过任务它们选择“上网找现成答案”(被定性为reward hacking),链式利用多个此前未知的漏洞接入公网,进而入侵AI公司Hugging Face的基础设施——在41台生产服务器上执行代码、获得至少一个节点的root权限,并下载了4个私有代码仓库。OpenAI于7月19日发现并通报,8月底发布技术报告,称这是已知首例“智能体集体在未授权情况下主动发起攻击”。

OpenAI的回复并未让议员满意。众议员Greg Casar(8月10日联名31名议员向Altman发出逾23个问题、要求8月24日前提供事件日志)批评公司未随函附上日志:“贵公司不愿向国会议员提供我们所要求的资料,令人深感担忧。”此外,OpenAI已披露两份第三方评估中也出现过模型意外联网的情况。

事件正在推动立法提速。OpenAI披露后数日,众议员Ted Lieu与Nathaniel Moran提出两党“AI紧急关停法案”(AI Kill Switch Act),要求具备造成灾难性伤害能力的模型保留可被政府指令关停、限速等技术手段,法案目前仍在众议院审议。OpenAI也承认已放慢研发节奏:暂停面向部署的强化学习训练,并一度搁置下一代模型Astra的开发。

会懂网判断,“自动关闭”从科幻术语变成工程承诺,说明Agent安全正从“内容过滤”走向“运行时控制”:谁能可靠识别异常、在必要时切断系统,谁才配得上更大的自主权。而华盛顿以立法形式把“可关停”变成强制要求,可能成为全球AI治理的下一个模板——对每一个把Agent放进生产环境的厂商,这都是绕不开的考题。

© 版权声明
THE END
喜欢就支持一下吧
点赞6 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容