动态

Qwen2.5-Max性能媲美DeepSeek-v3及顶级模型

Qwen2.5-Max性能媲美DeepSeek-v3及顶级模型
Arena.ai
最新的 @Alibaba_Qwen Qwen2.5-Max 现已加入竞技场,在硬基准测试中匹配 DeepSeek-v3 和顶级专有模型(GPT-4o/Claude 3.5)。

在 LMArena 上用你最棘手的问题挑战该模型!
Qwen
DeepSeek V3 的爆发引起了整个 AI 社区对大规模 MoE 模型的关注。与此同时,我们一直在构建 Qwen2.5-Max,这是一个基于海量数据预训练并经过精心设计的 SFT 和 RLHF 配方后训练的大型 MoE LLM。它实现了具有竞争力的 https://t.co/oHVl16vfje
动态Arena.ai2025-01-29原文

相关内容