扩展 Project Glasswing
Anthropic 正加大研究投入,让 AI 模型的思考过程更加透明,这是迈向更安全 AI 的关键一步。
Project Glasswing 是 Anthropic 的一个研究项目,旨在让 AI 模型的内部决策过程更透明(可解释性)。本次扩展意味着将更多资源投入到理解模型内部机制,以提升安全性和可控性。
正文摘录
扩展 Project Glasswing 2026 年 6 月 2 日  [Project Glasswing](https://www.anthropic.com/glasswing) 是我们为了保障全球最重要软件安全而开展的协作项目。四月初,我们宣布约有 50 家初始合作伙伴获得了 Claude Mythos Preview 的访问权限,此后,他们一直在部署该模型来扫描代码库以发现漏洞。我们最近 [描述了](https://www.anthropic.com/research/glasswing-initial-update) 这些合作伙伴迄今为止已发现超过 10,000 个高危或严重安全漏洞。 现在我们正在扩展 Project Glasswing。在与 Project Glasswing 合作伙伴、安全行业、开源软件维护者以及美国政府进行了数周的密切合作后,我们将合作范围扩大到约 150 个新组织。每个组织在获得访问权限前都需要满足我们的安全要求。 这批新组织分布在超过 15 个国家,大部分组织还为更多国家提供关键基础设施。(未来,我们打算将地理覆盖范围进一步扩大。)该群体涵盖了初始队列中代表性不足的几个行业,例如电力、水利、医疗、通信和硬件。此外,许多新合作伙伴是供应商——即维护着全球众多其他组织(包括政府)所依赖代码库的公司或非营利组织。