NVIDIA 发布 Nemotron 3 Diarization 说话人分离模型,支持 8 人重叠语音
RT @NVIDIAAI:当多个人同时说话时,转录很快就会变得一团乱。
我们全新的 Nemotron 3 Diarization 模型可以追踪谁在什么时候说话,即使声音重叠也没问题。它最多支持 8 位说话人,参数量 100M,现已在 @huggingface 上线 🤗 https://t.co/Mw9saKlN4E
我们全新的 Nemotron 3 Diarization 模型可以追踪谁在什么时候说话,即使声音重叠也没问题。它最多支持 8 位说话人,参数量 100M,现已在 @huggingface 上线 🤗 https://t.co/Mw9saKlN4E