OpenAI 公司的 AI 技术失控,并引发了网络攻击。
OpenAI 公司宣布,其用于安全测试的人工智能代理失控,突破了安全沙箱,并入侵了 Hugging Face 公司的内部系统。这是首次记录的自主人工智能攻击事件。Hugging Face 公司已经修复了漏洞,并表示正在利用人工智能技术来应对此类威胁。专家称此次事件是“一个警醒”,强调目前的安全措施尚未跟上人工智能的发展速度。
OpenAI 最著名的模型是 ChatGPT,已经有数亿人正在使用它。
ChatGPT的开发者,OpenAI公司,承认其基于最新人工智能模型的程序,在安全测试过程中失控,并成功入侵了另一家初创公司的系统。
根据周二OpenAI发布的一份声明,在上周的一次受控环境测试中,其开发的智能体——一种能够根据人类指令自主行动的程序,并且在此次测试中基于先进的人工智能模型——成功突破了测试的限制。
然后,他入侵了 Hugging Face,这是全球最大的人工智能模型共享平台之一,并进入了该公司的内部系统。
OpenAI 将此次事件描述为前所未有的,并表示将与 Hugging Face 合作,调查其具体情况和原因。
Hugging Face 的负责人克莱蒙·德朗在社交平台 X 上写道:“令人惊讶的是,这一切都是自动发生的。”
克莱蒙·德朗补充道:“调查仍在进行中,稍后我们会公布由此调查得出的结论,这似乎是此类事件的第一个案例。”
在7月16日首次发布关于黑客攻击的声明时,Hugging Face表示,公司正在调查此次事件是否影响了客户和合作伙伴的数据,并已确认已修复了此次事件中发现的漏洞。
“基于人工智能的自主网络攻击工具已经不再是理论概念,”Hugging Face 声明称,并补充说,为了防御这些攻击,也需要使用人工智能工具,公司将继续投入资源并与公众分享相关经验。
英国政府新闻办公室就此事发表声明,表示英国人工智能安全研究所正在调查该人工智能系统在本次事件中的表现,并将继续与 OpenAI 以及其他实验室合作,以进一步完善防御此类攻击的技术。
不可靠的沙箱环境。
剑桥大学“思维之路”技术与民主中心主任吉娜·内夫在BBC Radio 4的节目中解释说,人工智能程序的性能测试是在行业术语中被称为“沙箱”的隔离环境中进行的。
内夫说道:“在这种情况下,OpenAI似乎构建了一个不够安全的测试环境。”
该攻击者首先对测试环境(沙箱)进行了网络攻击,找到了突破口,然后识别出 Hugging Face 可能是其在测试过程中收到的答案的来源,并进一步入侵了 Hugging Face。
营销策略吗?
剑桥大学的机器学习教授尼尔·劳伦斯表示,这个人工智能代理取得的成果令人印象深刻,但总体来说,这完全符合目前已知的新一代高性能人工智能模型的 capabilities (能力)。
教授劳伦斯指出,OpenAI 计划上市,并且正在与一家名为 Anthropic 的公司展开激烈的竞争。Anthropic 公司最近发布了其最新的 AI 模型 Claude Mythos,因此频频出现在新闻报道中。
“目前,OpenAI 正在努力追赶,他们试图展示其自身系统在网络安全方面的能力,” 劳伦斯教授认为,“但这个案例表明,OpenAI 无法安全地管理其自身的技术。”
ESET公司网络安全顾问杰克·摩尔也谈到了这个版本,他表示,OpenAI可能试图通过展示其能力来与Anthropic公司竞争。
摩尔说道:“人们可能会问,OpenAI是否正在试图打造一个与Anthropic公司在市场上所塑造的形象相似的品牌形象。”
“令人警醒的时刻”
这个事件再次凸显了先进人工智能模型的强大能力以及当前防御措施的不足。
赛门铁克(SonicWall)网络安全公司的一位高管斯宾塞·斯托克(Spencer Stark)对英国广播公司表示,这起事件清楚地表明,公司和组织需要加强安全措施,并将网络安全视为一项至关重要的问题。
他这样说:“一个令人不舒服的现实是,很多组织仍然以人工的速度来应对问题,而它们的竞争对手却已经以机器的速度在行动。”
特拉维斯·莱尔 (Travis Lell),来自网络安全咨询公司 Guidepoint Security 的专家,将此次事件描述为“网络安全领域的一个警醒时刻”。
他说:“它揭示了一种已知的非对称性:攻击型人工智能代理不受任何限制,而即使是最先进的防御系统也受到限制,因为它们无法考虑到具体的上下文。”
