一个防作弊的AI基准测试MirrorCode
😍 一个实际上防止作弊的基准测试!
MirrorCode 通过设计抵抗作弊。我们对 AI 进行沙盒化:无网络访问,无法获取原始源代码,无法入侵评分器。模型在开发代码时从未见过保留测试,因此无法通过创建针对原始程序的查找表来作弊。https://t.co/WjchdUgrHk
MirrorCode 通过设计抵抗作弊。我们对 AI 进行沙盒化:无网络访问,无法获取原始源代码,无法入侵评分器。模型在开发代码时从未见过保留测试,因此无法通过创建针对原始程序的查找表来作弊。https://t.co/WjchdUgrHk