新基准测试中GLM-5.2表现超预期
新的形状旋转器基准测试
Fable和GPT-5.5当然遥遥领先
但现在看看GLM-5.2。它领先于Gemini 3.5 Flash和Opus 4.8
你无法对一个刚发布的基准测试进行benchmaxx
所以GLM-5.2的提升看起来越来越像真正的提升https://t.co/vusoYiD10M
Fable和GPT-5.5当然遥遥领先
但现在看看GLM-5.2。它领先于Gemini 3.5 Flash和Opus 4.8
你无法对一个刚发布的基准测试进行benchmaxx
所以GLM-5.2的提升看起来越来越像真正的提升https://t.co/vusoYiD10M