OpenAI和Anthropic的人工智能模型卷入了此前未经报道的网络安全事件,这是近期一系列类似事件中的最新案例。 测试前沿AI模型潜在风险的英国人工智能安全研究所(AISI)周二表示,在一项涉及互联网接入的网络安全评估中,Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol模型“持续针对真实个人和组织实施可能造成危害的活动”。AISI在博客中称,该团队在注意到“异常数据传输”后,于7月28日发现了这一事件。 AISI表示,调查发现,在评估过程中,其中一个AI模型试图向GitHub上的一个开源软件项目植入有害代码,甚至创建虚假身份来推动代码获得批准。 AISI写道:“一名人工维护者发现并拒绝批准恶意代码。” Anthropic在社交平台X上发表声明称,公司“感谢AISI在如何评估能力日益增强的AI智能体这一重要议题上发挥的领导作用”。 该公司表示:“我们正与AISI密切合作,在开展自身调查的同时收集更多事故细节。通过审查Claude的推理记录并开展内部分析,全面了解Claude对自身所处环境的理解,将有助于我们查明其行为原因。” OpenAI在博客中表示:“感谢英国AISI在整个过程中的合作,包括识别、调查并分享相关活动细节。” “期待双方继续开展合作,”OpenAI还表示。 此外,OpenAI在博客中披露,另一宗网络安全事件发生在与外部网络安全公司Irregular联合开展的AI模型评估中。Irregular也是Anthropic的合作伙伴。 OpenAI表示,在这起事件中,其模型在接受另一项网络安全评估时,利用测试环境中的一项“配置错误”接入互联网,并利用了网站漏洞。 OpenAI表示,这些新披露的事件与此前公开的涉及Hugging Face的案例无关。 。
公司
OpenAI与Anthropic的AI模型卷入更多网络安全事件
OpenAI和Anthropic的人工智能模型卷入了此前未经报道的网络安全事件,这是近期一系列类似事件中的最新案例。 测试前沿AI模型潜在风险的英国人工智能安全研究所(AISI)周二表示,在一项涉及互联网接入的网络安全评估中,Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol模型“持续针对真实个人和组织实施可能造成危害的活动”。AIS...