动态

Qwen3-Omni发布,首个端到端全模态AI模型

Qwen3-Omni发布,首个端到端全模态AI模型
Qwen
介绍 Qwen3-Omni —— 首个原生端到端全模态AI,统一文本、图像、音频和视频于一个模型,无需模态权衡!

在22/36个音频和音视频基准测试中取得SOTA
119L文本输入/19L语音输入/10L语音输出
211ms延迟 | 30分钟音频理解
完全可通过系统提示自定义
内置工具调用
开源低幻觉Captioner模型

开源了什么?
我们开源了Qwen3-Omni-30B-A3B-Instruct、Qwen3-Omni-30B-A3B-Thinking和Qwen3-Omni-30B-A3B-Captioner,助力开发者探索从指令跟随到创意任务的各种应用。

立即尝试
Qwen Chat: https://chat.qwen.ai/?models=qwen3-omni-flash
GitHub: https://github.com/QwenLM/Qwen3-Omni
Hugging Face模型: https://huggingface.co/collections/Qwen/qwen3-omni-68d100a86cd0906843ceccbe
ModelScope: https://modelscope.cn/collections/Qwen3-Omni-867aef131e7d4f
演示: https://huggingface.co/spaces/Qwen/Qwen3-Omni-Demo
动态Qwen2025-09-22原文

相关内容