Qwen3-TTS开源发布,支持语音设计与克隆
Qwen3-TTS 正式上线。我们已开源全系列——VoiceDesign、CustomVoice 和 Base——将高质量带给开源社区。
- 5个模型(0.6B & 1.8B)
- 自由形式的语音设计与克隆
- 支持10种语言
- SOTA 12Hz 分词器实现高压缩
- 全面的微调支持
- SOTA 性能
我们相信这可以说是开源 TTS 中最具颠覆性的发布。去打破它,构建些酷的东西吧。一切现已开放——权重、代码和论文。尽情享用。
GitHub:
https://github.com/QwenLM/Qwen3-TTS
Hugging Face:
https://huggingface.co/collections/Qwen/qwen3-tts
ModelScope:
https://modelscope.cn/collections/Qwen/Qwen3-TTS
博客:
https://qwen.ai/blog?id=qwen3tts-0115
论文:
https://github.com/QwenLM/Qwen3-TTS/blob/main/assets/Qwen3_TTS.pdf
Hugging Face Demo:
https://huggingface.co/spaces/Qwen/Qwen3-TTS
ModelScope Demo:
https://modelscope.cn/studios/Qwen/Qwen3-TTS
API:
https://alibabacloud.com/help/en/model-studio/qwen-tts-voice-design
- 5个模型(0.6B & 1.8B)
- 自由形式的语音设计与克隆
- 支持10种语言
- SOTA 12Hz 分词器实现高压缩
- 全面的微调支持
- SOTA 性能
我们相信这可以说是开源 TTS 中最具颠覆性的发布。去打破它,构建些酷的东西吧。一切现已开放——权重、代码和论文。尽情享用。
GitHub:
https://github.com/QwenLM/Qwen3-TTS
Hugging Face:
https://huggingface.co/collections/Qwen/qwen3-tts
ModelScope:
https://modelscope.cn/collections/Qwen/Qwen3-TTS
博客:
https://qwen.ai/blog?id=qwen3tts-0115
论文:
https://github.com/QwenLM/Qwen3-TTS/blob/main/assets/Qwen3_TTS.pdf
Hugging Face Demo:
https://huggingface.co/spaces/Qwen/Qwen3-TTS
ModelScope Demo:
https://modelscope.cn/studios/Qwen/Qwen3-TTS
API:
https://alibabacloud.com/help/en/model-studio/qwen-tts-voice-design