主推提及Qwen3-Omni模型,引用推详细介绍其多模态能力。
Qwen3-Omni 模型!
🚀 推出 Qwen3-Omni — 第一个原生端到端全模态AI,将文本、图像、音频和视频统一在一个模型中,无需模态权衡!
🏆 在22/36个音频和AV基准测试中达到SOTA
🌍 支持119种语言文本输入 / 19种语言语音输入 / 10种语言语音输出
⚡ 延迟211毫秒 | 🎧 支持30分钟音频 https://t.co/qGn34N7Xvd
🚀 推出 Qwen3-Omni — 第一个原生端到端全模态AI,将文本、图像、音频和视频统一在一个模型中,无需模态权衡!
🏆 在22/36个音频和AV基准测试中达到SOTA
🌍 支持119种语言文本输入 / 19种语言语音输入 / 10种语言语音输出
⚡ 延迟211毫秒 | 🎧 支持30分钟音频 https://t.co/qGn34N7Xvd