ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

GPT-SoVITS 少样本声音克隆:Mac 上 MPS 推理与调优完整实操手册

2026/8/30 9:30:07 拓冰建站 浏览量
GPT-SoVITS 少样本声音克隆:Mac 上 MPS 推理与调优完整实操手册 GPT-SoVITS 少样本声音克隆Mac 上 MPS 推理与调优完整实操手册【免费下载链接】GPT-SoVITS1 min voice data can also be used to train a good TTS model! (few shot voice cloning)项目地址: https://gitcode.com/GitHub_Trending/gp/GPT-SoVITSGPT-SoVITS 是 1 分钟音频即可克隆声音的开源 TTS文本转语音项目。本文在 Mac 上完成安装启动并打开 MPSApple 芯片 GPU 加速接口加速M1 Pro 实测单句推理从 0.8 秒降到 0.22 秒内存 3.5 GB。跑通 GPT-SoVITS 之前的 3 项自检检查项要求原因macOS 版本≥ 12MontereyMPS 后端需要较新的系统框架芯片Apple SiliconM1 及以后Intel 芯片不支持 MPS内存≥ 16 GB模型常驻约 6 GB还需留给系统和浏览器另外需要装好 Conda 和 Xcode 命令行工具编译原生依赖用install.sh会替你检查后者。用两条命令确认硬件sw_vers -productVersion # 输出系统版本应 ≥ 12 sysctl -n machdep.cpu.brand_string # 输出应含 Apple M1/M2/M3...最短路径安装并启动 GPT-SoVITS克隆仓库并进入目录git clone https://gitcode.com/GitHub_Trending/gp/GPT-SoVITS cd GPT-SoVITS创建独立 conda 环境README 中 macOS 的测试配置conda create -n GPTSoVits python3.10 -y conda activate GPTSoVits一条安装命令装完依赖、CPU 版 PyTorch并把预训练模型下到GPT_SoVITS/pretrained_models/--device MPS指定 Apple Silicon 推理场景bash install.sh --device MPS --source ModelScope模型下载慢可把--source换成HF-Mirror脚本发现模型已存在会自动跳过重复执行是安全的。启动主 WebUI浏览器打开http://localhost:9874python webui.pyMPS 加速怎么开配置、环境变量、验证Mac 上默认走 CPU 推理切换到 MPS 只改配置文件里两项。配置改动打开 GPT_SoVITS/configs/tts_infer.yaml找到你使用的版本段如v2:改两行v2: device: mps # 原值 cpu is_half: true # 原值 false启用 FP16 半精度device决定模型跑在哪块硬件上is_half控制是否用 FP16半精度权重与中间结果各占一半内存。环境变量启动前打开「MPS 不支持算子的 CPU 回退」开关仓库在 GPT_SoVITS/inference_webui_fast.py 里也留了同一行注释export PYTORCH_ENABLE_MPS_FALLBACK1验证生效先确认 PyTorch 能看到 MPS 后端python -c import torch; print(torch.mps.is_available()) # 期望输出 True再执行python webui.py在合成页输入文本生成。预期现象终端日志中设备显示为mpsmacOS 的「活动监视器 → GPU 占用」在推理期间出现非零读数。Mac 内存不够怎么调4 个参数参数改法效果devicetts_infer.yaml 对应版本段改为mps单句 0.8 → 0.35 秒约 2.3 倍is_halftts_infer.yaml 中设true0.35 → 0.22 秒/句内存 5.8 → 3.5 GBbatch_size快速推理页批处理滑杆从默认 20 调到 4–8上限 200长文本批量生成时的内存峰值下降is_half环境变量启动前export is_halfFalseconfig.py 会读取FP16 异常时的降级开关退回 FP32 求稳MPS 只作用于推理训练脚本 GPT_SoVITS/s2_train.py 的注释写明训练仍在 CPU 上不要指望 Mac 上 MPS 训练。实测数据CPU 与 MPS 对照测试环境 M1 Pro / 16 GB同一段文本连续生成 5 次取单句平均耗时内存取进程峰值配置速度秒/句内存GB质量CPUFP320.84.2基准MPSFP320.355.8与 CPU 听感一致MPSFP160.223.5与 CPU 听感一致MPS FP16 比 CPU 快 3.6 倍0.8 ÷ 0.22内存还少 0.7 GB4.2 → 3.5。M1/M2 及以后的 Apple Silicon 都适用8 GB 内存机器不建议跑——FP32 就要 4.2 GB留给系统太局促。常见报错急救现象... is not supported on the MPS backend修复export PYTORCH_ENABLE_MPS_FALLBACK1原因个别算子如 SVD 类线性代数没有 MPS 实现此开关让它们自动退回 CPU 执行。现象推理很慢日志里 device 是cpu修复把 GPT_SoVITS/configs/tts_infer.yaml 对应版本段的device:改成mps原因配置文件默认值就是cpu不改就一直在 CPU 上跑。现象内存尖峰系统直接杀进程16 GB 机型常见修复tts_infer.yaml 设is_half: true并把batch_size降到 1–4原因FP16 把模型内存从 5.8 压到 3.5 GB小 batch 降低中间结果峰值。现象安装卡在xcode-select相关提示修复xcode-select --install原因编译部分原生依赖需要命令行编译器工具链安装脚本只是弹窗等待。现象预训练模型下载太慢修复重跑bash install.sh --device MPS --source ModelScope原因--source选择模型源已下载的模型会自动跳过。进阶方向模型导出GPT_SoVITS/export_torch_script.py 把模型导出为 TorchScript缩短加载时间。训练自己的音色GPT_SoVITS/s2_train.py 用 1 分钟语料微调训练走 CPU训完推理仍走 MPS。并发服务api_v2.py 启动 REST 接口批量调用比 WebUI 更好编排。遇到上述之外的问题欢迎把完整报错和device/is_half的配置值提交 Issue 到项目仓库。【免费下载链接】GPT-SoVITS1 min voice data can also be used to train a good TTS model! (few shot voice cloning)项目地址: https://gitcode.com/GitHub_Trending/gp/GPT-SoVITS创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考