据marktechpost报道,NVIDIA近日推出开源端到端全双工语音对话模型NemotronLabs VoiceChat 11B。该模型可在统一网络中实现流式语音理解与生成,无需串联ASR、LLM和TTS等多个模型,显著降低端到端延迟。