Duix.Avatar 新手教程:10秒视频克隆你的形象和声音,本地离线生成数字人口播视频

📅 发布时间:2026/9/11 6:41:01
Duix.Avatar 新手教程:10秒视频克隆你的形象和声音,本地离线生成数字人口播视频
Duix.Avatar 新手教程10秒视频克隆你的形象和声音本地离线生成数字人口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款开源的离线数字人工具上传约 10 秒视频即可克隆外貌与声音输入文案就能自动生成口型匹配的口播视频。这篇新手教程带你完成本地部署做出第一个数字人全程可离线使用。先看结果部署完成后你能得到什么拍一段 10 秒左右的正面视频上传几分钟后就得到一个“你”的数字分身再输入一段文字它替你“念”出这段文案产出一条口型对齐的口播视频。主页有两个主入口左侧“Create Video”用于生成口播视频右侧“Create Avatar”用于克隆新的数字人下方是“我的作品”和“我的数字人”两个列表。项目简介与核心特性Duix.Avatar 是一款开源 AI 视频合成工具所有能力都在本地运行精确外貌与声音克隆高精度捕捉真人面部特征同时克隆声音、还原人声细微特征适合打造个人数字形象。文字与语音双驱动文字可转成语音驱动视频也能直接用音频驱动口型与表情适合口播、科普类内容。全离线操作数据全程在本机处理、无需联网素材不出机器适合对隐私敏感的场景。多模型管理与开放 API支持导入并管理多个模型另提供模特训练、音频合成、视频合成的本地接口适合开发者集成到自己的系统。和在线数字人服务相比它的差别主要在数据流向与成本对比项Duix.Avatar 本地部署在线数字人服务数据流向全程离线素材不出机器视频与文案上传云端使用成本开源免费按次收费定制化可自行修改扩展源码只能用平台提供的模板 部署快速开始Duix.Avatar 本地部署步骤前置检查清单项目要求系统Windows 1019042.1526 及以上或 Ubuntu 22.04 Desktop显卡英伟达 NVIDIA 显卡且已装驱动必须推荐 RTX 4070内存32GB 及以上磁盘WindowsD 盘空闲 30G 以上、C 盘 100G 以上Ubuntu磁盘空闲 100G 以上所有算力都在本地。没有英伟达显卡或驱动没装好服务端三个服务都起不来这是第一优先检查项。安装步骤克隆项目代码git clone https://gitcode.com/GitHub_Trending/he/Duix-AvatarWindows 先装 WSL 再装 Docker Desktop首次运行接受协议、跳过登录Ubuntu 安装 Docker、显卡驱动和 NVIDIA Container Toolkit安装好显卡驱动后用 nvidia-smi 命令确认可显示显卡信息进入项目的 deploy 目录启动服务端docker-compose up -d⏳ 等待约半小时完成镜像下载约 70G 流量建议连 WiFi再下载安装官方客户端安装包并打开结果验证成功信号Docker 里出现 Duix.Avatar-asr、Duix.Avatar-tts、Duix.Avatar-gen-video 三个服务且全部 Runninglite 精简版只有 gen-video 一个服务。失败信号服务反复重启或客户端打开后连不上服务端——最常见原因是显卡驱动没装好、内存不足16G 内存可能带不动。功能实操如何完成第一个数字人形象准备一段 10 秒左右的正面视频光线充足、面部清晰、人一直在说话在客户端主页点击“Create Avatar”上传这段视频等待外貌与声音训练完成新模型出现在“我的数字人”列表视频里必须有人声说话程序要靠这段声音做声音克隆无声或纯音乐的视频会创建失败。如何生成一条口播视频点击“Create Video”选择要使用的数字人模型输入口播文案确认声音生成完成后在“我的作品”列表中预览并保存脚本支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语共 8 种语言同一模型可生成多语言版本视频。适用场景与人群自媒体创作者不用真人出镜用个人数字形象批量产出口播视频适合日更和多账号矩阵。企业培训与营销产品介绍、内训、科普内容快速转成口播视频省去反复拍摄的成本。开发者与技术爱好者完全开源、本地 API 开放可嵌入自己的业务系统或按需求改代码。❓ 常见问题速查执行 docker-compose up -d 时连接失败、拉镜像超时Docker Hub 官方源不稳定在 Docker Engine 设置里配置国内镜像源并重启再重新执行。新增模特时报错用于创建模特的视频必须有人说话的声音否则无法做声音克隆。定制模特时 Connection refusedASR 服务启动较慢服务端启动后等几分钟再做克隆内存只有 16G 的机器可能带不动。出问题怎么查日志客户端在设置菜单点“打开日志”查看 main.log服务端在 Docker 对应服务页点“复制”导出日志。延伸阅读更完整的部署细节与开放 API 说明见 README_zh.md常见问题与提问前自查步骤见 doc/常见问题.md服务端容器配置文件在 deploy/客户端源码在 src/商用授权条款见 LICENSE【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考