ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

30分钟跑通Duix.Avatar数字人克隆与本地部署

2026/9/11 8:44:45 拓冰建站 浏览量
30分钟跑通Duix.Avatar数字人克隆与本地部署 30分钟跑通Duix.Avatar数字人克隆与本地部署【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是硅基智能开源的 AI 数字人digital human工具支持本地部署与 API 调用上传一段 10 秒左右的视频即可克隆形象与声音输入文案或音频后生成口型同步的口播视频。全链路离线运行适合想低成本做数字人视频的内容创作者以及想集成数字人能力的开发者。 部署前的环境核对先确认机器满足以下条件否则后三个 Docker 服务起不来项目要求系统Windows 1019042.1526 及以上或 Ubuntu 22.04 Desktop显卡NVIDIA 显卡且已装驱动硬性要求内存32GB 及以上磁盘WindowsC 盘空闲大于 100G镜像、D 盘大于 30G数据Ubuntu空闲大于 100GC 盘空间不足时可以在 Docker Desktop 的 Settings → Resources → Advanced 里把 Disk image location 改到空间更大的磁盘。Windows 部署步骤确认 WSL 可用并更新wsl --list --verbose wsl --update安装 Docker Desktop首次启动时接受协议、跳过登录。克隆仓库并进入项目git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar进入/deploy目录启动服务端compose 文件就放在这个目录里cd deploy docker-compose up -d这一步会拉取并启动 duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video 三个服务镜像约 70G首次启动请预留半小时左右。想省资源可以改用轻量版只起一个 gen-video 服务cd deploy docker-compose -f docker-compose-lite.yml up -d执行docker ps看到三个容器均为 Running 即部署成功。从项目 Release 页下载对应系统的预构建安装包Windows 双击.exe完成客户端安装。Ubuntu 22.04 部署步骤sudo apt update sudo apt install docker.io sudo apt install docker-compose按 NVIDIA 官方文档安装显卡驱动nvidia-smi能显示显卡信息即成功。接着安装 nvidia-container-toolkit 并配置 Docker 运行时sudo nvidia-ctk runtime configure --runtimedocker sudo systemctl restart docker启动服务端cd deploy docker-compose -f docker-compose-linux.yml up -d客户端下载 AppImage 版本直接双击运行root 用户桌面环境下需在终端执行并追加--no-sandbox参数。 部署成功后的使用流程创建数字人。主界面右侧点 Create Avatar上传一段 10 秒左右的视频。注意视频里必须有人清晰说话系统要同时提取面部特征和声音特征无语音的视频会直接报错。你会看到成功后我的数字人列表里多出一张带头像的卡片可以重命名。生成口播视频。点 Create Video 选中刚创建的数字人输入文案或上传音频文件提交生成。你会看到作品出现在 My Works 列表并带进度完成后直接播放、保存成片口型与语音自动对齐。管理与调试。My Works 支持关键词搜索和分页浏览历史作品随时可找。右上角 Setting 菜单可以打开客户端日志、切换界面语言支持中、英、日、韩、法、德、阿、西 8 种、查看用户协议。排查问题前先开日志效率最高。 生成卡住或服务起不来时看这里按现象 → 原因 → 动作逐条对照docker-compose up -d失败报 request canceled / 连接超时→ Docker Hub 源不稳定 → 在 Docker 配置的registry-mirrors里加国内镜像源后重试或换可直连源的网络。三个服务起不来容器反复退出→ 没有 NVIDIA 显卡或驱动没装好 → 用nvidia-smi验证本项目全部算力在本地无 GPU 时服务必然启动失败。创建数字人失败提示与声音相关→ 上传的视频里没有人在说话 → 重新拍摄 10-20 秒的说话视频再上传。创建时报 Connection refused→ asr 服务启动慢或内存不足16G 可能带不动→ 等服务全部 Running 后再等几分钟重试必要时加大内存。生成卡住或 heygen-tts 容器反复重启→ 音频处理环节出错 → 点开对应容器查看日志定位报错重启该服务再试。以上都解决不了时对照仓库里的常见问题里面覆盖了镜像源、无声视频、asr 连接失败等高频问题。⚙️ 服务端结构与本地 API部署完的/deploy实际是三个独立服务全部通过http://127.0.0.1本地调用不依赖外网duix-avatar-tts基于 fish-speech 的声音克隆与文本转语音本地端口 18180duix-avatar-asr基于 fun-asr 的音频识别端口 10095duix-avatar-gen-video数字人视频合成端口 8383。对开发者完整链路是三段式 API先调 18180 端口的模特训练接口/v1/preprocess_and_tran提取声音参考再调/v1/invoke合成音频最后调 8383 端口的/easy/submit提交视频合成、/easy/query查进度。客户端里这些调用的组织逻辑可以读 视频生成服务 和 声音服务 两个文件参数示例在 README 的开放 API一节。下一步Duix.Avatar 把形象克隆、声音克隆和口播视频生成串成了一条本地流水线主要成本是等待镜像下载。遇到问题先看常见问题仍无解再到项目 Issue 区或技术交流群提问。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考