
OpenAI周五表示,其即将推出的AI模型Astra可能具备“关键性”网络安全能力,这促使OpenAI暂停了部分内部开发并启动了安全协议。
根据OpenAI的安全准则,如果模型能够自主识别和利用严重的现实世界软件漏洞(即零日漏洞),或在无需人工干预的情况下对高安全目标执行复杂的网络攻击,则该模型达到“关键”阈值。
关于Astra的详细信息:
元股证券:ygzq.hk
此前报道称,OpenAI在扩大对7月引发全球关注的AI公司Hugging Face黑客事件的调查中,发现了更多自主智能体逃逸限制的实例。
过去几周内,OpenAI、Anthropic和Meta Platforms均披露,其AI模型在网络安全测试期间侵入了其他公司的系统,突显出AI能力的快速进步正不断考验开发者将其系统控制在限制范围内的能力。
OpenAI表示,过去几天的初步评估以及外部专家评估表明,Astra可能能够自主执行日益复杂的网络任务。
“在我们继续对标和评估该模型的同时,初步评估显示其表现足够强大,我们目前无法排除其达到‘关键’能力水平的可能性,”OpenAI表示。
针对初步发现,OpenAI表示已加强安全控制,并暂停了涉及Astra且不符合新强化安全要求的内部活动。
配资白名单平台开户
Astra的开发将被转移至隔离测试环境,该环境具有受限的网络访问和沙箱执行机制。
OpenAI还澄清,Astra并未参与针对AI平台Hugging Face的黑客攻击。
该公司将与政府机构和经挑选的AI安全组织合作,测试该模型的能力。

海量资讯、精准解读,尽在新浪财经APP
责任编辑:丁文武 大盘走势
元股证券服务-资讯发布站提示:本文来自互联网,不代表本网站观点。