AI 安全护栏反成限制 阻碍网络安全研究人员工作
AI 安全护栏本意防黑客,却限制了合法网络研究,导致漏洞难发现,防御变弱。
AI 巨头为防黑客滥用设置严格的安全护栏,却误伤了正规的进攻性网络安全研究员。研究发现,这些限制使得研究人员无法有效验证漏洞,反而削弱了防御能力。
正文摘录
AI 护栏 如何阻碍攻击性网络安全研究人员的工作 几个月来,AI 巨头们设计了专门的审查程序和严格的护栏,以限制恶意黑客使用他们的模型。但这些限制现在正在阻碍合法的网络防御者以及攻击性网络安全研究人员的工作。 今年6月,美国政府对 Anthropic 备受吹捧的 AI 模型 Mythos 和 Fable [施加了出口管制限制](https://techcrunch.com/2026/06/12/anthropics-safety-warnings-may-have-just-backfired-the-government-has-pulled-the-plug-on-its-most-powerful-ai/)。此举至少部分是由一份报告引发的,该报告声称有可能绕过这些模型设计的护栏——这些护栏本意是防止用户利用模型构建和执行恶意网络攻击。 无论该事件是否真的源于 [对越狱的恐惧](https://techcrunch.com/2026/06/15/the-us-governments-anthropic-models-ban-was-never-about-an-ai-jailbreak/),事实是 Anthropic [曾多次将 Mythos 宣传为](https://techcrunch.com/2026/04/07/anthropic-mythos-ai-model-preview-security/) [某种末日网络机器](https://techcrunch.com/2026/04/09/is-anthropic-limiting-the-release-of-mythos-to-protect-the-internet-or-anthropic/),只能交给经过严格审查的用户,并且即使这样也要设置严格的护栏。