实测:10 秒视频克隆数字人,Duix.Avatar 本地离线部署全流程

📅 发布时间:2026/9/11 17:06:46
实测:10 秒视频克隆数字人,Duix.Avatar 本地离线部署全流程
实测10 秒视频克隆数字人Duix.Avatar 本地离线部署全流程【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想做数字人口播又不想往云端传素材、按条付费Duix.Avatar 是开源的 AI 数字人本地部署工具录 10 秒视频就能克隆形象和声音离线生成口型同步的成片。本文带你从零跑通环境出第一条自己的视频。先确认环境没问题Duix.Avatar 的算力全在本地没有英伟达显卡就跑不起来。部署前对照下面这张表核一遍缺任何一项后面都会卡住。项目要求系统Windows 10 19042 及以上或 Ubuntu 22.04内存32G 及以上必需显卡英伟达 NVIDIA 显卡 正确安装驱动必需磁盘C 盘留 100G 以上、D 盘留 30G 以上Windows 上还要先装好 Docker DesktopWSL 2 后端。驱动装完后在终端敲nvidia-smi能正常打印显卡信息说明 GPU 这条路是通的。30 分钟跑起来服务端用 Docker 起三个容器fun-asr 做语音识别fish-speech 做声音合成gen-video 做视频合成。先把源码拉下来进部署目录git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy预期源码拉取完成当前目录能直接列出 docker-compose.yml、docker-compose-lite.yml 这些部署脚本。接着启动服务端docker-compose up -d首次要拉镜像约 70G 流量、半小时左右建议连 WiFi。跑完后回到 Docker看到 asr、tts、gen-video 三个容器都是 Running 就算成功。显存只有 8G 或磁盘紧张的机器改用docker-compose -f docker-compose-lite.yml up -d只起一个 gen-video 服务模型体积约 10G不占 100G 磁盘。50 系显卡则换用 docker-compose-5090.yml。客户端直接下官方构建包Windows 双击 setup.exe、Ubuntu 双击 AppImage 就能用不用再装依赖。它启动后会连本机服务端开始工作。第一件事产出你的作品跑起来之后界面上就三个动作位Create Avatar、Create Video、My Avatars从克隆到出片一条线走完。上传一段约 10 秒、带说话声音的视频训练出你的数字人模特外貌和声音一次成型存进 My Avatars。之后在 Create Video 里粘贴文案用克隆出的声音朗读、口型自动对齐就能产出播报视频脚本支持中、英、日、韩等 8 种语言。也支持上传一段录音让数字人按你的原声口播拿现成配音改口型也够用。最容易踩的几个坑拉镜像报 request canceled、连接超时。Docker Hub 官方源不稳定去 Docker Engine 里配国内镜像源再重启。新增模特报错、克隆失败。素材视频里必须有人说话的声音纯静音镜头做不了声音克隆换一条带口播的视频重试。定制模特报 Connection refused。fun-asr 服务启动慢服务端刚起来别急着克隆等几分钟再操作16G 内存的机器可能起不全服务。更多排查思路可以看 常见问题。下一步本地出片链路到这里就通了。想省算力直接调它开放的本地 API照 实现代码 里的 video 服务改就行。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考