动态

英国AI安全研究所发布BPJ越狱研究及防御建议

英国AI安全研究所发布BPJ越狱研究及防御建议
Andrew Curran
'作为我们负责任披露流程的一部分,我们正在分享有关BPJ的信息。BPJ不仅对AI开发者有影响,也对任何试图保护AI系统的人有影响。使用“单次交互”防御(即每次只检查一个交互)很难防御BPJ;相反,我们的结果表明,防御者应采用“批量级别”监控系统,以检测跨流量的可疑模式。'
OpenAI Newsroom
英国AI安全研究所(AISI)已发表关于“边界点越狱”(BPJ)的新研究——一种针对系统安全防护开发通用越狱的方法。
我们已经部署了缓解措施,以应对通过这项BPJ研究发现的越狱问题,并进一步
动态Andrew Curran2026-02-17原文

相关内容