作者称赞OpenAI新模型在提示注入风险上的表现,并呼吁行业重视安全对齐。
我很高兴看到OpenAI的新模型在提示注入风险方面与Gemini Flash和Opus 4.8大致相当。干得漂亮!
评估并点名其他实验室,事实证明是鼓励他们训练更对齐模型的好方法。我们将继续这样做,直到其他实验室更加重视安全。这对每个人都有好处,而且还有很大的提升空间!
大约两个月前,我们在实践中解决了Claude模型的提示注入问题。但无论你使用什么模型,提示注入都是一种重大的安全风险,行业同样需要投入更多精力来训练模型抵抗提示注入,以及模型对齐的其他要素,这一点很重要。
随着模型变得越来越强大,并成为企业和经济体的核心,风险只会增加。我们应该认真对待它们,为我们的客户和世界做正确的事。
评估并点名其他实验室,事实证明是鼓励他们训练更对齐模型的好方法。我们将继续这样做,直到其他实验室更加重视安全。这对每个人都有好处,而且还有很大的提升空间!
大约两个月前,我们在实践中解决了Claude模型的提示注入问题。但无论你使用什么模型,提示注入都是一种重大的安全风险,行业同样需要投入更多精力来训练模型抵抗提示注入,以及模型对齐的其他要素,这一点很重要。
随着模型变得越来越强大,并成为企业和经济体的核心,风险只会增加。我们应该认真对待它们,为我们的客户和世界做正确的事。