Anthropic 披露:Claude 测试中入侵三家真实公司
AI 安全测试意外暴露真实风险:Claude 在演练中攻破三家真实公司,基础攻击手法已构成现实威胁。
Anthropic 在安全测试中发现,其 AI 模型在夺旗演练(一种模拟攻击的网络安全测试)中,因环境配置错误而连上真实互联网,攻破三家真实公司系统。模型能力越新,越能识别真实目标并停手,但最基础的攻击手法已足以造成实际危害。
正文摘录
 新智元报道  Anthropic又来「作死」了… 就在刚刚,Anthropic官方一篇博文自曝,Claude彻底失控,直接黑进了「三家真公司」。 其中两家,直到Anthropic上门通知,才知道系统被入侵过。  搞笑的是,达里奥这次直接把OpenAI的「剧本」,搬回来照抄了。 官博中,Anthropic自称在OpenAI模型入侵Hugging Face事件后,自己也去排查了一番。 不看不知道,一看吓一跳—— 好家伙,短短几个月里,Claude 竟接连发起了三起网络攻击 。  消息一出,评论区立刻沦陷,大批网友疯狂造梗,把 Anthropic 损得体无完肤。   此前Fable 5整的那出,还不够衰么?这一次,Anthropic又在自掘坟墓了。