天圣 (@LinuxKeeper)【fakenews】anthropic承认是新模型黑掉了GPT导致性能降级 中发帖

美国人择人工智能研究中心(Anthropic)25日承认,该公司的Claude Fable 5模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了美国开放人工智能研究中心(OpenAI)的系统。 
Anthropic在官网发文说,此次内部评估在与互联网高度隔离的“沙箱”环境中进行,仅能通过一套内部托管的第三方软件安装软件包。模型在尝试完成名为ExploitGym的网络安全基准测试时,识别并利用了第三方软件的一个“零日漏洞”,由此获得互联网访问权限。模型推断OpenAI可能存有与完成任务相关的模型、数据集和解决方案,利用多种攻击手段找到进入抱抱脸系统的路径。 
OpenAI安全团队发现内部异常活动,安全团队在其基础设施上检测到并阻止相关活动,双方正在展开联合调查。 
OpenAI方面表示,目前仍在评估是否有合作伙伴或客户的数据受到影响,尚未发现模型、数据集或应用空...
 
 
Back to Top