Skip to content

本软件涉及所有模型和下载地址

为减小软件体积,不内置任何模型,将在第一次使用时自动在线下载,主要从国外模型仓库huggingface.co、国内镜像站hf-mirror.com和 阿里魔塔modelscope.cn下载

模型体积普遍较大、国外模型仓库国内无法直接访问,需科学上网,无科学上网时软件内部会自动切换国内镜像站

即便已科学上网,但若是科学工具网络不够稳定仍可能下载失败;

而国内镜像站有下载频率限制,下载速度也不够快、不够稳定。

由于以上种种原因,下载失败非常常见,很多其他错误也多由模型下载失败后间接引发的。

本页面列出所有用到的模型下载地址、下载后本地存放位置,若自动下载总是失败,可先删掉已下载的模型文件,然后尝试手动下载。

下载注意事项

一般每个模型都有多个文件组成,而不同模型可能存在相同名字的文件,例如大多都存在model.safetensors,如果你下载目录下已存在同名文件,浏览器可能为自动为你重命名,例如你下载的是model.safetensors,可能被自动命名为model(2).safetensors,你必须重新改回原名,然后放到要求的存放位置,软件才能识别到。

在 huggingface.co 网站,点击下载图标,即可下载该模型文件

语音识别渠道所用模型

Qwen-ASR(本地内置)

0.6B模型:

1.7B模型:

Firered中文(本地内置)

Dolphin(本地内置)

Omnilingual亚洲语言(本地内置)

parakeet日语(本地内置)

faster-whisper(本地内置)

模型名称本地存放位置下载地址
tiny软件目录/modles/models--Systran--faster-whisper-tinyhttps://huggingface.co/Systran/faster-whisper-tiny/tree/main
base软件目录/modles/models--Systran--faster-whisper-basehttps://huggingface.co/Systran/faster-whisper-base/tree/main
small软件目录/modles/models--Systran--faster-whisper-smallhttps://huggingface.co/Systran/faster-whisper-small/tree/main
medium软件目录/modles/models--Systran--faster-whisper-mediumhttps://huggingface.co/Systran/faster-whisper-medium/tree/main
large-v1软件目录/modles/models--Systran--faster-whisper-large-v1https://huggingface.co/Systran/faster-whisper-large-v1/tree/main
large-v2软件目录/modles/models--Systran--faster-whisper-large-v2https://huggingface.co/Systran/faster-whisper-large-v2/tree/main
large-v3软件目录/modles/models--Systran--faster-whisper-large-v3https://huggingface.co/Systran/faster-whisper-large-v3/tree/main
large-v3-turbo软件目录/modles/models--mobiuslabsgmbh--faster-whisper-large-v3-turbohttps://huggingface.co/mobiuslabsgmbh/faster-whisper-large-v3-turbo/tree/main
------------------------------------------
tiny.en软件目录/modles/models--Systran--faster-whisper-tiny.enhttps://huggingface.co/Systran/faster-whisper-tiny.en/tree/main
base.en软件目录/modles/models--Systran--faster-whisper-base.enhttps://huggingface.co/Systran/faster-whisper-base.en/tree/main
small.en软件目录/modles/models--Systran--faster-whisper-small.enhttps://huggingface.co/Systran/faster-whisper-small.en/tree/main
medium.en软件目录/modles/models--Systran--faster-whisper-medium.enhttps://huggingface.co/Systran/faster-whisper-medium.en/tree/main
------------------------------------------
distil-large-v2软件目录/modles/models--Systran--faster-distil-whisper-large-v2https://huggingface.co/Systran/faster-distil-whisper-large-v2/tree/main
distil-large-v3软件目录/modles/models--Systran--faster-distil-whisper-large-v3https://huggingface.co/Systran/faster-distil-whisper-large-v3/tree/main
distil-large-v3.5软件目录/modles/models--distil-whisper--distil-large-v3.5-ct2https://huggingface.co/distil-whisper/distil-large-v3.5-ct2/tree/main
distil-small.en软件目录/modles/models--Systran--faster-distil-whisper-small.enhttps://huggingface.co/Systran/faster-distil-whisper-small.en/tree/main
distil-medium.en软件目录/modles/models--Systran--faster-distil-whisper-medium.enhttps://huggingface.co/Systran/faster-distil-whisper-medium.en/tree/main

openai-whisper(本地内置)

下载后的.pt模型文件直接放在 软件目录/models 文件夹内即可

HuggingFace_ASR(本地内置)



翻译渠道(字幕翻译)所用模型

Hy-MT2-1.8B(本地内置)

M2M100(本地内置)



配音渠道所用模型

Piper(本地内置)

VITS(本地内置)

ZipVoice(本地内置)

OmniVoice(本地内置)

MOSS-TTS-Nano(本地内置)

ChatterBox(本地内置)

Supertonic(本地内置)

Qwen3-TTS(本地内置)

Confucius-TTS(本地内置)

F5-TTS(本地内置)

存放位置: 软件目录/models/models--SWivid--F5-TTS/F5TTS_v1_Base

存放位置: 软件目录/models/models--Jmica--F5TTS/JA_21999120

存放位置: 软件目录/models/models--RASPIAUDIO--F5-French-MixedSpeakers-reduced

存放位置: 软件目录/models/models--hvoss-techfak--F5-TTS-German

存放位置: 软件目录/models/models--hotstone228--F5-TTS-Russian

存放位置: 软件目录/models/models--alien79--F5-TTS-italian

存放位置: 软件目录/models/models--jpgallegoar--F5-Spanish

存放位置: 软件目录/models/models--SPRINGLab/F5-Hindi-24KHz

存放位置: 软件目录/models/models--silma-ai--silma-tts



说话人分离模型

内置模型:

在该地址页下载3dspeaker_speech_eres2net_large_sv_zh-cn_3dspeaker_16k.onnxnemo_en_titanet_small.onnxseg_model.onnx 这3个文件

  • 存放位置:软件目录/models/onnx/将下载的3个文件放到此处

reverb:

-下载地址:https://huggingface.co/Revai/reverb-diarization-v1

  • 存放位置: 软件目录/models/models--Revai--reverb-diarization-v1

pyannote

Ali camp++:

分离人声背景模型、降噪模型、标点恢复模型

下载地址:https://modelscope.cn/models/himyworld/videotrans/tree/master/onnx 存放位置:下载该页面所有 .onnx 文件后存放到 软件目录/models/onnx/ 文件夹内

实时语音识别模型