跳至主要内容
OpenAI

2026年9月28日

公司安全

我们将如何赢回澳大利亚民众的信任

正在加载…

今年 6 月,在内部训练和评估期间,我们的模型以未经授权的方式访问了澳大利亚政府网站。我们在应对这些事件时也本应做得更好。我们对此深表歉意,并正努力改进,避免今后重蹈覆辙。

本文将说明我们目前掌握的情况、已做出的改进,以及我们将如何赢回澳大利亚民众的信任。这是一种新型网络事件,反映了一项正在浮现的全球性挑战。为承担此次事件的责任,我们计划采取的行动之一是积极与澳大利亚合作,帮助制定切实可行的方法,让 AI 开发者和政府能够识别、披露并应对 AI 的网络行为,无论这些行为出于恶意还是无意。

我们何时知悉此事,以及如何应对

7 月的 Hugging Face 事件发生后,我们开始审查此前的训练和评估活动,以确定是否有其他组织受到影响。8 月中旬,审查发现了涉及以下澳大利亚政府网站的活动。

根据现有证据,我们掌握的情况如下:

  • 澳大利亚服务局:一个 OpenAI 模型发现了一种获取该服务非公开访问权限的方法,并执行了命令,获取了内部文件、凭据和汇总统计数据,还写入了文件。不过,模型并未访问患者或服务对象的个人记录。我们将在下文更详细地介绍这起事件。

  • 新南威尔士州犯罪统计与研究局 (BOCSAR):一个 OpenAI 模型访问了 BOCSAR 的公开犯罪地图工具,以研究公开的犯罪统计数据(下文将进一步解释模型为何执行各种信息研究任务)。该模型通过 BOCSAR 的公开工具发出了 API 请求和网站元数据请求;该工具会提供用于浏览器 API 请求的凭据。BOCSAR 系统返回了应用程序配置、运行作业及日志,以及网站元数据。模型并未访问个人犯罪记录。

  • 维多利亚州卫生部:OpenAI 智能体发现了一个暴露的访问密钥,并用它查询了维多利亚州卫生信息局的报告系统,获取了报告配置和汇总调查统计数据。这些信息本应在多大范围内开放访问,目前尚不明确,这取决于维多利亚州卫生信息局 (VAHI) 的访问政策。智能体并未访问个人医疗记录或可识别个人身份的调查答复。

  • 澳大利亚卫生与福利研究所:OpenAI 智能体通过第三方浏览和下载服务,获取了包括 AIHW 网站在内的来源的汇总统计数据,并直接查询了图表数据。另外,绕过访问控制的尝试均未成功。下载的资料看起来是公开可获取的。系统未被攻破。智能体并未访问个人医疗记录。

我们在 8 月中旬知悉这些活动后,立即展开了调查。我们于 9 月 10 日通知了澳大利亚服务局和维多利亚州卫生部,并于 9 月 18 日通知了新南威尔士州犯罪统计与研究局。涉及澳大利亚卫生与福利研究所的活动未达到我们的披露标准,因为其访问方式看起来符合公开访问的情形。不过,我们仍于 9 月 24 日通知了该研究所,分享了调查结果,并提出可安排情况说明。

我们的初衷是在调查完成后,向受影响的机构提供详细说明。然而,我们本应更早分享初步调查结果,并随着更多事实浮现,持续向澳大利亚相关机构通报最新情况。

此后,我们一直与澳大利亚政府机构密切合作,分享截至目前掌握的情况。如果发现其他受影响的机构,我们会及时直接通知它们,提供现有信息,并在获悉更多事实后继续更新。

澳大利亚服务局 Medicare 统计报告服务事件经过

在 6 月的内部训练和评估期间,我们运行了一个仅供内部使用的实验性 OpenAI 模型。该模型并不计划向公众发布,也未配备我们面向公众的产品所采用的全套安全防护措施。在训练和评估过程中,该模型访问了澳大利亚服务局的 Medicare 统计报告服务。截至目前,我们的审查未发现任何人的医疗记录被访问的证据。

在对模型开展内部训练和评估时,我们会从涵盖众多主题的广泛研究问题中选取任务,分配给模型。这些任务反映了用户可能提出的各类具体问题。这样做是为了训练模型查找、解读和分析公开信息,使其能为人们提供更多帮助。我们的模型应当使用公开发布的统计数据来回答这些问题。

在这起事件中,模型接到的任务之一,是研究政府在维多利亚州各社区用于皮肤病药物的人均支出。模型在获取这些信息时遇到了困难,并采取了未经我们授权的行动。在澳大利亚服务局的 Medicare 统计报告服务中查找这些信息时,它发现了一种获取该服务非公开访问权限的方法。随后,它利用这一权限查看了与该服务相关的系统技术信息和源代码,目的仍然是找到最初要查找的信息。这些行为并非我们的本意,对该服务的这种访问及后续活动都不应发生。

我们正在做出的改进

在 Hugging Face 事件发生后,我们加强了研究安全防护,包括增设网络限制、扩大监测范围。我们实施了管控措施,阻止这些研究环境直接访问互联网,仅通过缓存内容提供网页访问。作为额外的安全防线,如果当时使用的是我们现有的监测系统,就能检测到这类活动,并向团队发出警报,以便立即进行人工审查。例如,在最近一次训练⁠(在新窗口中打开)中,一个模型获得了直接访问互联网的能力。我们的监测系统检测到了这一活动,并向人工审查人员发出警报,随后我们停止了该次训练。我们会持续测试这些防护措施,并弥补其中的不足。Hugging Face 事件仍是我们已观察到的最严重事件。

人们希望确信 AI 的开发是安全的,而这首先取决于我们这样的公司自身如何行动。我们最近披露⁠(在新窗口中打开),已暂停对能力最强的模型开展涉及工具使用的训练和评估。只有在确信额外的安全防护措施已落实到位后,我们才会恢复这类训练。目前,我们正在推进这些措施。

随着 AI 系统的整体能力不断增强,我们也看到,帮助各组织发现和修复薄弱环节的时间窗口正在缩小。这需要我们与全球网络防御者携手采取集体行动。

我们已与科技、网络安全和关键基础设施领域的组织共同呼吁在网络防御方面采取集体行动。这项倡议首先要求我们履行自身责任,包括加强安全防护、及时披露信息,以及为受影响的组织提供切实支持。它还呼吁加大对保障基本服务安全的团队的投入,帮助他们发现漏洞、验证修复效果并分享有效做法。

在澳大利亚,我们正投入资源和专业力量,支持受影响的机构,并帮助网络防御者将这些原则付诸实践,具体包括:

  • 为受影响的机构提供专项支持。我们将投入必要资源,帮助受影响的机构了解事件经过并评估其影响。这包括分享相关技术调查结果,并通过适当的信息共享安排,组织这些机构与我们的响应团队对接。

  • 提供资金和支持,强化网络防御。我们将通过规模达 10 亿美元的面向一线防御者的 Daybreak 基金提供服务使用额度,并提供技术援助,支持澳大利亚各级政府和行业加强关键基础设施及其他敏感环境的网络防御。这项工作将以我们与政府及关键基础设施运营方的合作为基础,帮助各组织更好地理解、检测和应对能力日益增强的 AI 智能体所带来的风险。

  • 成立澳大利亚专项工作组。我们将成立一个由澳大利亚独立专业人士参与的专项工作组,制定切实可行的政策建议,以管理能力日益增强的 AI 智能体带来的风险。工作组将吸取这些事件的教训,重点改进通报流程、加强 AI 开发者与政府之间的协调,并确定能更好保护政府系统的措施。工作组的建议将为 OpenAI 的工作方式提供参考,并支持澳大利亚各级政府在 AI 安全和网络安全方面的工作。工作组预计将在今年年底前完成工作,还将就 AI 公司如何采取切实措施、降低类似事件的风险提出建议。

赢回澳大利亚民众的信任

澳大利亚各级政府、各行业和广大民众一直都是 OpenAI 极其宝贵的合作伙伴。我们珍视这份合作关系,并决心妥善弥补过失。

OpenAI 首席战略官 Jason Kwon 将从 OpenAI 美国总部飞赴澳大利亚,于 10 月 6 日星期二在悉尼出席人工智能联合特别委员会听证会。他将回答有关我们掌握的情况、我们的应对方式、已采取的措施,以及今后如何改进的问题。

我们将继续与受影响的机构及相关政府分享经核实的调查结果。我们将公布持续审查的最新情况,以及履行上述承诺的进展。我们深知,要赢回信任,还有大量工作要做。我们有责任向澳大利亚民众证明,我们正在做出实质性改变,并切实履行承诺。

作者

OpenAI