动态

Anthropic等前沿模型可威胁国家,呼吁治理

Anthropic等前沿模型可威胁国家,呼吁治理
Tenobrus
也许这还不清楚,所以让我直说:截至目前,Anthropic(以及Anthropic中的少数个人)有能力直接攻击并对美国政府、中国以及全球超级大国造成重大损害。像NSA这样的政府机构内部没有超越前沿模型的模型或防御能力。如果他们选择这样做,他们可能从政府系统窃取绝密信息,控制包括军事基础设施在内的关键基础设施,破坏或修改最高层政府成员之间的通信,并可能在一段时间内不被察觉地持续活动。拥有大量对手不知道的零日漏洞,能带来巨大的不对称优势。

他们没有利用这一点来获取权力或破坏世界秩序。他们公开发布了拥有这些能力的信息,并努力修复这些缺陷。你应该庆幸美国前沿实验室已经证明自己非常值得信赖,并关心公共利益。但关键是你要明白我们正处于一个新阶段。私人实体现在拥有直接挑战和影响政府垄断影响力和暴力的权力。而Anthropic当然不是唯一一家,OpenAI的内部模型也不太可能落后太多。

这一趋势几乎在每个维度上都将加速,而不是放缓。我对事态发展的预测是,美国政府将在未来两年内相对迅速地将实验室收归国有。我很难想象他们如何接受这种威胁的存在。但这增加了一类全新的治理问题,因为我们把如此广泛的能力从私人实体转移到了公共实体手中。
动态Tenobrus2026-04-07原文

相关内容