动态

Anthropic 发布迄今最详细威胁情报报告,披露 Claude 滥用案例与处置

Andrej Karpathy
RT @AnthropicAI:我们发布了迄今为止最详细的威胁情报报告。

报告涵盖了人们如何试图滥用 Claude——用于网络攻击、影响力行动、监控、生物学以及制造武器——以及我们如何发现并阻止了这些行为。

我们瓦解了报告中的每一项行动,并从中吸取教训来强化我们的防护措施。在适当的情况下,我们也把发现分享给了有关当局和其他 AI 公司。

这些案例并不典型:我们重点展示的是所见过的最高级的滥用行为。但它们尤其值得讨论,因为它们向我们揭示了 AI 滥用的走向、我们的防护在哪些地方有效、又在哪些地方需要改进。

我们发布这份报告,是为了让其他人也能在自己的平台上识别出同样的活动,也让公众更清楚地了解新兴威胁是如何演变的。

阅读报告:https://t.co/0EJUnYEgfz
动态Andrej Karpathy2026-09-10原文

相关内容