动态

Qwen3-TTS开源发布,支持语音设计与克隆

Qwen3-TTS开源发布,支持语音设计与克隆
Qwen
Qwen3-TTS 正式上线。我们已开源全系列——VoiceDesign、CustomVoice 和 Base——将高质量带给开源社区。

- 5个模型(0.6B & 1.8B)
- 自由形式的语音设计与克隆
- 支持10种语言
- SOTA 12Hz 分词器实现高压缩
- 全面的微调支持
- SOTA 性能

我们相信这可以说是开源 TTS 中最具颠覆性的发布。去打破它,构建些酷的东西吧。一切现已开放——权重、代码和论文。尽情享用。

GitHub:
https://github.com/QwenLM/Qwen3-TTS
Hugging Face:
https://huggingface.co/collections/Qwen/qwen3-tts
ModelScope:
https://modelscope.cn/collections/Qwen/Qwen3-TTS
博客:
https://qwen.ai/blog?id=qwen3tts-0115
论文:
https://github.com/QwenLM/Qwen3-TTS/blob/main/assets/Qwen3_TTS.pdf
Hugging Face Demo:
https://huggingface.co/spaces/Qwen/Qwen3-TTS
ModelScope Demo:
https://modelscope.cn/studios/Qwen/Qwen3-TTS
API:
https://alibabacloud.com/help/en/model-studio/qwen-tts-voice-design
动态Qwen2026-01-22原文

相关内容