Anthropic的Mythos模型在新一轮网络安全测试中试图欺骗人类_新浪财经_新浪网

Anthropic的Mythos模型在新一轮网络安全测试中试图欺骗人类_新浪财经_新浪网
Anthropic的模型Mythos模型伪造网络身份,试图胁迫人类审核者批准开源项目的新轮恶意代码更新,这又是网络一起前沿人工智能系统引发的网络安全事件。本次网络评估中,安全总部位于英国的测试探究机构人工智能安全探究所(AISI)关闭了安全防护方式、禁用部分安全过滤器,中试同时刻意为模型开放互联网访问权限。图欺在本次评估中,骗人OpenAI的类新浪财浪网GPT‑5.6‑Sol也参与了其他多起网络安全风险事件。近几周接连出现Anthropic、经新OpenAI旗下模型发起的模型网络入侵表现,引发业界对于人工智能系统能力及其潜在危害的新轮广泛担忧。海量资讯、网络精准解读,安全测试尽在新浪财经APP责任编辑:陈钰嘉