行业新闻

OpenAI 安全透明度负责人离职,三名研究员因泄密被解雇

OpenAI 安全透明度负责人离职、三名安全研究员被解雇,既显示其安全团队持续动荡,也牵出对外信息披露的边界问题。

OpenAI 负责安全透明度的 David Robinson 已离职,公司未公布继任者。他的团队负责把模型的安全评估、风险判断整理成公开的 system card(系统卡,随模型发布的安全说明文件)。同期,三名从事安全与对齐研究的员工因向一家外部 AI 安全机构分享敏感信息被解雇。

正文摘录

- title: OpenAI 安全团队持续地震!负责人离职,三名员工因泄密被开 - sourcecompany: 量子位 - bodymarkdown: David Robinson,OpenAI Safety Systems 团队内的“安全透明度”职能负责人。 据 BI 报道,Robinson 本人尚未公开说明离职原因,OpenAI 也没有公布继任者。 几乎每次 OpenAI 发布重要模型时,Robinson 和他领导的团队都会为模型撰写一份“system card”。 用 Robinson 自己的话说,他所做的工作,是帮助外界理解并信任 OpenAI 为保障系统安全所开展的技术工作。 安全透明度团队要做的,就是 把内部的技术发现、风险判断和部署决定,整理成外界能够看懂的公开材料。 这项工作归属于 Safety Systems 内部的 Trustworthy AI 团队,产出包括 system card、Deployment Safety Hub、安全研究博客和公开治理文件。 在其中需要写明:一款模型训练所用的方法、接受了哪些安全评估、在生物和网络攻击等高风险领域达到了什么能力、内部采取了什么安全措施、采取措施后还有什么风险等等。 Robinson 自己也不无自豪地说,这是 OpenAI 向外界提供的有关公司技术安全工作“最详细、最全面的说明”了。 除此外,Robinson 还是 OpenAI《Preparedness Framework 2.0》的主要起草人。 这套框架用于追踪前沿模型可能带来的严重风险,并提前规定模型达到某种能力后,公司需要进行哪些评估、增加哪些防护措施。 比如这第二版框架里,就新增了三类需追踪的能力:生物与化学能力、网络安全能力,以及 AI 自我改进能力。

阅读原文(qbitai.com)→

行业新闻衡宇2026-10-03原文

相关内容