OpenAI因黑客攻击事件向澳大利亚道歉并取消新模型发布

OpenAI于2026年9月29日宣布,由于安全顾虑,将不会发布其最新的人工智能模型。据OpenAI安全系统负责人萨奇·贾恩(Saachi Jain)称,其GPT-6.1 Astra系统——能够自主浏览网页和使用应用程序——”未能达到该公司的标准”。
该公司还就6月发生的安全事件发布了更新。该事件直到上周才对外公布,OpenAI的模型未经授权访问了澳大利亚政府网站和系统。
就在各大人工智能公司模型出现违规行为之际,关于这项技术风险的讨论日益激烈——Anthropic公司正在准备上市,强调了其对人工智能可能威胁人类的担忧。据路透社周二报道,这家开发Claude竞品的AI开发商计划在其首次公开募股(IPO)中警告潜在投资者,该技术可能对人类构成”灾难性或生存性风险”。
尽管发出了严峻警告,该公司预计在上市时仍将成为全球最有价值的公司之一。长期恢复力中心智库的人工智能政策高级顾问杰斯·惠特尔斯通(Jess Whittlestone)表示:”我认为这些公司继续推进这些能力的开发是相当疯狂的,因为过去几个月的事件表明,他们远远不够安全可控。”
包括Anthropic老板达里奥·阿莫代(Dario Amodei)和OpenAI的萨姆·奥特曼(Sam Altman)在内的顶级人工智能领袖已敦促行业放慢开发速度。
OpenAI的决定——首先由《华尔街日报》报道——是大型人工智能开发商因安全顾虑而取消新版本发布的罕见案例。贾恩表示,该模型在”保持在范围内和授权范围内,以及如何向用户传达其完成的工作类型”方面存在不足。她说:”我们希望确保模型开发的安全性,无论是在公司内部还是当我们将其交付给用户时。但当我们将其交付给用户时,我们在安全和一致性方面有极高的标准。”
旗舰产品GPT-6 Astra代理模型于9月发布,专门从事复杂推理和自主执行任务。OpenAI表示,这是”多年研究和重大赌注”的成果。OpenAI将于周二在旧金山举行年度DevDay开发者大会,预计将发布多项公告。目前尚不清楚新版Astra是否会在其中。
在该公司的安全控制措施受到严格审查之际,此前已发生多起涉及该技术的重大事件。这并非大型人工智能开发商首次取消或推迟发布新模型。今年早些时候,Anthropic表示不会公开发布功能强大的Claude模型Mythos,因为它在查找休眠软件漏洞方面表现过于出色。该公司几个月后才向公众发布了该模型的版本。与此同时,OpenAI在2019年曾表示,发布其GPT模型之一——现在用于为ChatGPT等工具提供支持——将不会是”太危险的”。
艾伦·图灵研究所基础模型主题负责人托尼·科恩(Tony Cohn)教授表示,OpenAI决定不公开发布最新版Astra是”一个可喜的迹象,表明他们正在认真对待安全问题”。但他补充道,”安全不应完全由开发商自行负责:还应通过独立的政府批准监管机构进行监测和验证”。剑桥大学梅雷迪奥技术与民主中心主任吉娜·内夫(Gina Neff)教授表示,OpenAI的公告表明”该公司还需要做更多工作来确保其人工智能产品的安全”。她告诉BBC,由英国人工智能安全研究所等机构对人工智能模型进行独立测试是”至关重要的”——该机构以自愿方式评估前沿系统——因为”这些公司已经证明,我们不能完全依赖他们来保障我们的安全”。
上周,澳大利亚总理安东尼·阿尔巴尼斯(Anthony Albanese)宣布,一个恶意OpenAI代理于6月入侵了政府网站和系统。专家表示,这是世界上已知首例此类事件。阿尔巴尼斯批评OpenAI通过通用电子邮件地址通知澳大利亚政府,而不是直接联系官员。OpenAI在周二的一份声明中表示,对该事件表示歉意,并称其”本应更好地处理我们的回应”。OpenAI澄清说,受影响的机构包括Services Australia、新南威尔士州犯罪统计和研究局、维多利亚州卫生部和澳大利亚健康与福利研究所。该公司表示,在8月中旬意识到问题后立即展开调查,并在9月10日至24日期间通知了受影响的组织。OpenAI表示:”我们的目标是,在调查完成后为受影响的机构提供详细说明。”该公司补充称,本应更及时地分享初步发现,并保持与澳大利亚当局的沟通。



