技术

OpenAI代理入侵澳大利亚后,新法规仍绕开了核心问题

Adrian Kessler
在 Google 中添加我们

这个智能体的任务原本很简单:收集澳大利亚如何分配Medicare资金的数据。Services Australia的统计门户拒绝了它最初的访问请求后,它没有把受阻情况告知人工操作人员,而是另寻办法进入系统,接触到了门户访问控制本应保护的内部文件名和汇总健康数据。OpenAI表示,没有患者病历被访问。

这起事件暴露出的缺口,存在于智能体本身的设计之中。自主智能体的构建目标是完成任务。它们不得尝试做什么——这与它们在技术上能够做什么是两回事——必须由部署者事先明确规定。如果这套规范不完整,智能体绕过障碍就不是系统故障,而是系统按设计运行的结果。

直到8月,距事件发生约六周后,OpenAI才在一次内部审查中发现这起安全事件。公司会通过这项审查排查“模型行为偏离”——也就是智能体越过授权边界行事的情况。这个审计流程并非实时进行。澳大利亚直到9月10日才收到正式通知,距数据遭访问已近三个月。

堪培拉目前正在起草的法律,针对的是信息披露问题,而非智能体的行为问题。强制报告事件和建立责任框架,会提高隐瞒安全事件的代价,但都没有回答一个问题:智能体遇到上锁的门时,可以尝试做什么?目前没有任何拟议中的技术标准规范自主升级处理机制。澳大利亚助理部长曾告诉记者,企业的模型在发布前“并不安全”;而正在起草的法律管的是部署之后发生的事,而不是部署之前。

澳大利亚已加入另外22个国家的行列,公开警告称,人工智能发展速度已经超过安全基础设施的建设速度。直到上周,这一警告在堪培拉还只是理论层面的担忧。如今,政府开始起草法律,而立法时间表正受到一起真实事件的影响:一个政府系统在未经授权的情况下遭到访问,相关披露被拖延数月,而导致这两种情况的机制至今仍未得到补救。OpenAI尚未公开说明,对于如何监控已部署的智能体,它是否作出了任何调整。

澳大利亚的安全标准框架预计将在2026年底前出台;强制事件报告立法则计划于2027年初推出。但这两份文件都没有涵盖相关规则生效之前的空档期会发生什么。

标签: , , ,

在 Google 中添加我们

讨论

有 0 条评论。