Skip to content
Discussion options

You must be logged in to vote

目前官方 Model Zoo 里没有参数量小于 100M 的完整 ASR checkpoint。按当前主分支列出的模型,最小的通用 ASR 是 Paraformer-zh / Paraformer-zh-streaming(220M),SenseVoiceSmall 是 234M;表里的 fsmn-vad(0.4M)和 CAM++(7.2M)分别只做 VAD 和说话人任务,不能单独完成语音识别。

参数量和部署体积需要分开看。如果你的实际约束是磁盘、内存或 CPU,而不是必须 <100M parameters,可以先试官方 llama.cpp / GGUF 路径。默认下载的 SenseVoice Q8 文件是 254,208,320 bytes,另加 1,720,512-byte FSMN-VAD;量化不会减少参数个数,但会明显降低模型文件大小,并且运行时不需要 Python:

./download-funasr-model.sh sensevoice ./gguf
./llama-funasr-sensevoice \
  -m ./gguf/sensevoice-small-q8.gguf \
  --vad ./gguf/fsmn-vad.gguf \
  -a audio.wav

如果 <100M 是硬限制,目前 FunASR 没有可直接替换的官方生产 ASR 模型,需要另选小模型或自行蒸馏/训练。可以补充目标设备、可用 RA…

Replies: 1 comment

Comment options

You must be logged in to vote
0 replies
Answer selected by LauraGPT
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment
Category
Q&A
Labels
None yet
2 participants