ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

Duix-Avatar 数字人本地部署:三条命令跑通视频生成

2026/9/11 3:01:07 拓冰建站 浏览量
Duix-Avatar 数字人本地部署:三条命令跑通视频生成 Duix-Avatar 数字人本地部署三条命令跑通视频生成【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar如果你有一块 NVIDIA 显卡想把自己做成数字人、离线产出口播视频Duix-Avatar 可以直接上手。部署完成后你得到的是一套全本地运行的数字人工具包上传 10 秒视频克隆形象和声音输入文字或音频就能生成口播视频。全程约 1 小时其中大半是等待 Docker 镜像下载。 能力速览形象与声音克隆上传一段有人声的视频克隆五官和音色生成数字人模型。口播视频生成输入文字或音频数字人自动对口型产出视频。全离线所有计算在本地完成素材不离开机器。八种语言中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语。开放 API模特训练、音频合成、视频合成都提供本地接口方便二次开发。部署前自查项目要求系统Windows 1019042 及以上或 Ubuntu 22.04显卡NVIDIA 显卡显存 8GB 以上驱动已装好内存32GB 及以上16GB 可能出现服务起不来磁盘Windows 的 C 盘空闲 100GB 以上、D 盘 30GB 以上Linux 100GB 以上运行环境Docker DesktopWindows、Docker nvidia-container-toolkitLinux三个镜像体积较大首次拉取约 70GB 流量。Windows 上可以把 Docker 的磁盘镜像目录挪到其他分区⏱ 路径选择路径配置文件适合人群难度耗时完整三服务deploy/docker-compose.yml需要声音克隆加视频合成低约 1 小时lite 轻量版deploy/docker-compose-lite.yml只做视频合成不需要 ASR低约 30 分钟50 系显卡版deploy/docker-compose-5090.yml5090 等新款 NVIDIA 显卡中约 1 小时Ubuntu 用户把配置文件换成 docker-compose-linux.yml其余步骤相同。跟着做获取代码。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar这一步把客户端源码和 deploy/ 部署配置下载到本地目录。准备运行环境。Windows 先装 WSLwsl --install再安装 Docker Desktop 并接受协议Ubuntu 直接装 Dockersudo apt install docker.io docker-compose服务依赖 GPU 容器NVIDIA 驱动必须装好装完用nvidia-smi能显示显卡型号。启动服务。cd deploy docker-compose up -dDocker 拉取三个镜像并启动 tts、asr、gen-video 服务首次约 30 分钟到 1 小时。安装客户端。项目仓库的 release 里有现成安装包Windows 是 exeLinux 是 AppImageroot 用户启动要加--no-sandbox参数。客户端自动连接本地 8383 服务端口。✅ 验收清单Docker 中 duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video 三个容器都是 Running。打开客户端能看到首页首次启动弹出用户协议同意后进入创作。上传一段 10 秒以上、带人声的视频数字人创建成功。输入文字生成一条口播导出视频口型与语音匹配。出问题时客户端在设置菜单点“Open Log”查看 main.log服务端在 Docker 里查看各容器的 Logs。⚠️ 三个最容易踩的坑镜像拉取超时。现象docker-compose up -d报 registry-1.docker.io 无法连接、context canceled。解法在 Docker Engine 的 registry-mirrors 里加国内镜像源Apply restart 后重跑命令。数字人克隆报 Connection refused。现象asr 服务启动慢刚启动就连会连接被拒。解法服务启动后等 3~5 分钟再克隆内存 16GB 的机器可能直接起不来。创建模特失败。现象上传成功声音环节报错。解法模特视频必须包含人说话的声音纯无声或只有 BGM 的视频用不了。继续深入各系统安装细节与开放 API 调用示例README_zh.md常见问题自查清单与日志位置doc/常见问题.md客户端调用服务端的逻辑src/main/service/启动服务上传一段视频做出第一条数字人口播。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考