资讯动态

Duix.Avatar AI 数字人免费部署指南:10 秒视频克隆形象与声音

发布时间:2026/9/11 23:02:53 来源:尧图企业网站定制
Duix.Avatar AI 数字人免费部署指南10 秒视频克隆形象与声音【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想让屏幕里的人替你念稿、录课、做产品介绍Duix.Avatar 是一款开源的 AI 数字人工具上传一段 10 秒左右的说话视频它在本地克隆你的外貌和声音之后输入文字就能产出口播视频。全文按装环境 → 起服务 → 出视频的顺序写照着做你能独立跑通第一个数字人作品。 项目速览Duix.Avatar 是一个面向本地部署的开源数字人项目外貌克隆、声音克隆、视频合成三步全部跑在你自己的电脑上。它解决的核心问题是重复出镜形象和声音只需要克隆一次之后用文字或音频就能无限次驱动这个形象产出视频。适合想做口播内容但又不想反复拍摄、更不想把原始素材交给云端服务的个人创作者、老师和企业用户。客户端同时提供中文与英文界面支持 Windows 与 Ubuntu 两套系统。项目说明核心痛点口播视频要反复出镜拍摄云端服务贵且素材要上传运行方式全离线算力全部在本地生成过程不依赖网络费用开源免费商用用户量超 10 万或年营收超 1000 万美元的企业需签商业许可协议系统门槛Windows 10 19042.1526 及以上或 Ubuntu 22.04 Desktop硬件门槛英伟达显卡 驱动必需32G 内存官方标注必要仓库地址见下文部署与首次运行第一步的 clone 地址️ 动手前的运行门槛这套项目最硬的门槛是英伟达显卡和内存这两项过关后后面的部署基本不会卡。系统要求Windows 10版本 19042.1526 或更高用winver查看或 Ubuntu 22.04 Desktop官方在内核 6.8.0-52-generic 上验证过安装英伟达显卡并装好最新驱动。本项目所有算力都在本地没有显卡或没装驱动三个服务都起不来Windows 需要 D 盘空闲空间大于 30G后续数字人与作品存在这里硬件分两档看最低可用英伟达显卡驱动装好 32G 内存。官方常见问题里明确提到 16G 内存可能启动不了所以 32G 是建议的底线流畅运行第 13 代英特尔酷睿 i5-13400F RTX 4070 32G 内存这是官方给出的推荐配置关键经验内存决定能不能启动显卡决定生成快不快。如果预算有限要取舍别在内存上省。 部署与首次运行整个部署分四步拉代码、装系统底座、起服务、装客户端其中只有第三、四步需要花时间等待。第一步拉取项目git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar判断成功本地出现 Duix-Avatar 目录里面有deploy/、src/和 README_zh.md。第二步准备系统底座Windows 路线先执行wsl --list --verbose看有没有装过 WSL没有就执行wsl --install网络原因可能失败多次多试几次即可安装中会要求设置新的用户名和密码记住它执行wsl --update把 WSL 更新到最新按本机 CPU 架构下载安装 Docker Windows 版首次运行接受协议并跳过登录判断成功任务栏 Docker 图标显示 Engine running。C 盘镜像文件默认占 100G 以上空间不够时可以在 Docker 设置里把磁盘镜像位置改到其他磁盘Ubuntu 路线先docker --version检查没装就执行sudo apt update再安装docker.io和docker-compose两个包装好英伟达驱动后执行nvidia-smi能显示显卡信息说明驱动 OK安装 NVIDIA Container ToolkitDocker 调用 GPU 的必要组件添加仓库后执行sudo apt-get install -y nvidia-container-toolkit再执行sudo nvidia-ctk runtime configure --runtimedocker最后sudo systemctl restart docker第三步启动服务端cd deploy docker-compose up -dUbuntu 用户换成docker-compose -f docker-compose-linux.yml up -dRTX 50 系列显卡如 5090用docker-compose -f docker-compose-5090.yml up -d只要视频合成能力、不装语音克隆的可用精简版docker-compose -f docker-compose-lite.yml up -d判断成功Docker 里出现三个服务——duix-avatar-tts语音合成、duix-avatar-asr语音识别、duix-avatar-gen-video视频合成lite 版本只有一个 gen-video。第四步安装客户端Windows下载官方构建的安装包双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu下载 Linux 版 AppImage 直接双击启动root 用户需要进终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox判断成功客户端打开能看到项目速览里那张主界面图。首次启动注意事项磁盘Windows 的 D 盘大于 30G、C 盘大于 100G存镜像不足就改位置Ubuntu 磁盘空闲大于 100G流量与时间首次拉镜像约消耗 70G 流量官方估算半小时左右具体以实际网速为准建议连 WiFi服务刚起来时 ASR语音识别服务加载较慢等几分钟再开始克隆形象否则会报 Connection refused✨ 核心能力拆解按使用频率从高到低你会用到四项能力。1. 形象与声音克隆主界面 Create Avatar它做了什么上传一段 10 秒左右的正面说话视频程序一边捕捉面部特征一边从音频里提取音色。 你会得到什么一个可反复使用的数字人模型存进My Avatars列表后续任何视频都能调用它。 适合什么场景任何人制作数字人的第一步企业也可以借此做出统一口径的代言形象。2. 口播视频生成主界面 Create Video它做了什么选一个已克隆的模型输入文案或直接上传音频文字被转成克隆音色的语音画面口型自动对齐。 你会得到什么一条可播放、可发布的口播视频收在My Works列表里。 适合什么场景课程讲解、产品介绍、批量口播。文案支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语八种语言。3. 多模型管理它做了什么客户端支持导入多个模型按场景切换。 你会得到什么每条业务线配一个专属数字员工不用反复克隆。 适合什么场景多账号矩阵、多个发言人并存的团队。4. 本地开放 API它做了什么Docker 启动后在本地暴露端口127.0.0.1:18180 负责语音预处理与合成127.0.0.1:8383 负责视频合成提交与进度查询。 你会得到什么自己的脚本可以直接串起训练 → 配音 → 合成整条链路不必经过图形界面。 适合什么场景想把数字人能力接进现有业务的开发者。 端到端演示从一段视频到一条口播最完整的路径就两步先克隆出你自己再用文字驱动产出视频。输入准备录一段 10 秒左右、正面、光线充足的视频内容必须是你本人说话——声音克隆的素材就取自这段音频无声视频会直接报错。关键操作打开客户端主界面点 Create Avatar上传视频等待训练完成点 Create Video选中刚创建的模型粘贴口播文案开始生成到 My Works 列表查看成品产出一条形象和声音都与你一致、口型对齐的播报视频。可复用参数建议视频要有人说话 正面服务端刚启动时先等几分钟再开始克隆生成期间尽量别开其他占用显卡的程序。⚠️ 避坑手册官方常见问题里的高频坑有四个按拉镜像 → 素材 → 服务 → 显卡的顺序排查能覆盖大部分卡住的情况。现象可能原因处理动作docker-compose up -d拉镜像失败报 request canceled / 超时Docker Hub 官方源连接不稳定开全局模式或在 Docker 的 daemon.json 里配置国内镜像源官方 FAQ 附了示例配置新增模特时客户端直接报错模特视频没有声音或画面里没有人说话重录视频必须含人声且本人在说话声音克隆才有素材训练日志出现 Connection refusedASR 服务启动慢或内存不足16G 可能启动不了服务端启动后等几分钟再操作内存不足就升到 32G三个服务全都起不来没有英伟达显卡或驱动没装对执行nvidia-smi检查安装或更新驱动后重试通用排查动作遇到表里没写的问题先确认三个服务是否都处于 Running 状态Docker 界面或docker ps有服务异常就抓两套日志——客户端日志在主界面右上角菜单里服务端日志在 Docker 的容器日志页面点复制。两套日志都正常的话回到 deploy 目录重新执行docker-compose up -d把服务更新到最新很多坑在新版里已经修掉了。 进阶与资源跑通客户端之后仓库里有三组资料值得直接翻。doc/常见问题.md官方 FAQ含自查步骤和提问模板deploy/四份 docker-compose 配置分别是标准版、lite 版、Linux 版和 RTX 50 系列版src/main/service/model.js、src/main/service/video.js、src/main/service/voice.js模特训练、视频合成、语音合成三组本地 API 的调用示例src/main/config/config.js本地服务地址与数据目录约定模特视频、声音样本、生成产物都存到哪里一目了然进阶方向一句话如果你会 Node.js 18 并能从源码构建客户端就可以跳过图形界面直接对接 127.0.0.1:18180 和 127.0.0.1:8383 这两个端口搭一套自己的批量出片流程。结语Duix.Avatar 的价值点很朴素素材不离开本机、使用免费、克隆一次即可无限次复用。仓库地址在部署与首次运行的第一步你现在就能做的第一件小事——录一段 10 秒的正面说话视频把三个 Docker 服务拉起来克隆出你的第一个数字人。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价