Skip to content

Feature Request: 集成 FunASR 提升语音识别体验 #25

Description

@LauraGPT

你好!GMTalker 3D 数字人项目非常棒,集成了语音识别、TTS 和嘴型驱动。

建议使用 FunASR(16K+ stars)作为 ASR 引擎:

  • 流式识别:Paraformer-streaming 专为实时对话设计
  • 170 倍实时 GPU 推理:降低数字人交互延迟
  • 内置 VAD + 标点 + 说话人分离
  • WebSocket 实时服务:原生支持 WebSocket 流式传输

已被 Fay(12.8K stars)、Linly-Talker(3.3K stars)等 10+ 数字人项目使用。

from funasr import AutoModel
model = AutoModel(model="paraformer-zh-streaming", vad_model="fsmn-vad")
result = model.generate(input="audio.wav")

Metadata

Metadata

Assignees

No one assigned

    Labels

    No labels
    No labels

    Projects

    No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions