你好!GMTalker 3D 数字人项目非常棒,集成了语音识别、TTS 和嘴型驱动。
建议使用 FunASR(16K+ stars)作为 ASR 引擎:
- 流式识别:Paraformer-streaming 专为实时对话设计
- 170 倍实时 GPU 推理:降低数字人交互延迟
- 内置 VAD + 标点 + 说话人分离
- WebSocket 实时服务:原生支持 WebSocket 流式传输
已被 Fay(12.8K stars)、Linly-Talker(3.3K stars)等 10+ 数字人项目使用。
from funasr import AutoModel
model = AutoModel(model="paraformer-zh-streaming", vad_model="fsmn-vad")
result = model.generate(input="audio.wav")
你好!GMTalker 3D 数字人项目非常棒,集成了语音识别、TTS 和嘴型驱动。
建议使用 FunASR(16K+ stars)作为 ASR 引擎:
已被 Fay(12.8K stars)、Linly-Talker(3.3K stars)等 10+ 数字人项目使用。