动态

Anthropic 发布最详细威胁情报报告,披露并阻断 Claude 被滥用案例

Charlie Marsh
RT @AnthropicAI:我们正在发布迄今为止最详细的威胁情报报告。

报告涵盖了人们如何试图滥用 Claude——用于网络攻击、影响力行动、监控、生物学以及制造武器——以及我们如何发现并阻止了这些行为。

我们瓦解了报告中的每一起行动,并利用从中得到的经验来强化我们的防护措施。在适当的情况下,我们也把发现分享给了监管机构和其他 AI 公司。

这些案例并不典型:我们重点呈现的是我们所见过的最复杂的一些滥用行为。但它们尤其值得讨论,因为它们向我们展示了 AI 滥用将走向何方、我们的防护在哪里有效、又在哪里需要改进。

我们发布这份报告,是为了让其他人也能在自己的平台上识别出同样的活动,也是为了让大家更清楚地了解新兴威胁是如何演变的。

阅读报告:https://t.co/0EJUnYEgfz
动态Charlie Marsh2026-09-10原文

相关内容