字节跳动Doubao-1.5-pro模型性能强劲,MoE架构高效
字节跳动的Doubao-1.5-pro取得了令人印象深刻的结果!MoE架构和"Deep Thinking"模式使其能用显著更少的激活参数达到密集模型性能。高效AI的重大进步。#AI #LLM #MoE
字节跳动发布Doubao-1.5-pro
- 包含"Deep Thinking"模式,在AIME基准上超越O1-preview和O1模型。
- 在常用基准上优于deepseek-v3、gpt4o和llama3.1-405B。
- 基于MoE架构,激活参数远少于 https://t.co/o26j9yJRR5