行业新闻

OpenAI 披露并阻断一起协同模型蒸馏攻击

OpenAI 公开了一起有组织的蒸馏攻击:外部方试图批量套取模型的推理能力,这类行为正成为模型厂商新的安全攻防线。

OpenAI 说明其如何阻断一场有组织地提取受保护模型推理过程的行动,并称正在加强针对对抗性蒸馏(adversarial distillation,即用另一个模型的输出来训练自家模型、绕过原始训练投入的做法)的防御措施。

正文摘录

- title: 瓦解一场有组织的模型蒸馏行动 - sourcecompany: OpenAI - bodymarkdown: 了解 OpenAI 如何瓦解了一场旨在提取受保护模型推理过程的行动,并正在加强对对抗性蒸馏的防御。

阅读原文(openai.com)→

行业新闻2026-09-30原文

相关内容