酷,新出的一款端到端AI语音模型:Voila,全双工能同时听和说,低延迟,预置了一百万种语音 还支持ASR、TTS以及多

酷,新出的一款端到端AI语音模型:Voila,全双工能同时听和说,低延迟,预置了一百万种语音 还支持ASR、TTS以及多语言语音翻译

端到端架构,支持全双工的低延迟对话,延迟195毫秒,超人类平均响应时间

能实时自主对话,持续聆听、推理以及主动回应,通过文本指令可以定义说话者的身份以及语气等特征

原链接