Claude Fable 5 二次被越狱,黑客称破解不如谷歌搜索
Claude Fable 5 二度被越狱,但黑客结论是费力不讨好,凸显 AI 安全攻防的边际效益递减。
Anthropic 的 Claude Fable 5 发布仅两天后再次被黑客越狱。黑客 Vitto Rivabella 耗时 20 小时成功绕过三层防线(意图分类器、实时断路器、思维链防火墙),但最终只拿到一堆边角料信息,他感叹直接谷歌搜索更快更全。Anthropic 已启动公开漏洞披露项目,鼓励外部黑客报告新越狱方法,但无金钱奖励。
正文摘录
 新智元报道  【新智元导读】 Anthropic 刚把 Fable 5「放出来」没几天,它就又被黑客当众扒了底裤。 Anthropic 官方确认:Fable 将于 7 月 7 日后暂时从订阅计划移除,但一旦容量允许,将尽快恢复为标准订阅内容。 这无疑是个好消息。  但 Fable 5 再次被越狱了!这已经是该模型第二次防线失守。 黑客 Vitto Rivabella 公开宣布:Fable 5,又被攻破了。  要知道,Claude Fable 5 恢复访问时,Anthropic 特意强调:上次 Fable 5 被禁就是因为亚马逊的研究人员发现了一种绕过 Fable 5 安全防护的方法。  所以这次的安全分类器得到针对性加强。  然而,这个神话只维持了 2 天。