资讯动态

AI视频生成工具本地部署:从零到出片30分钟

发布时间:2026/9/11 10:30:37 来源:尧图企业网站定制
AI视频生成工具本地部署从零到出片30分钟【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想做数字人口播视频却总在云端排队等GPUDuix.Avatar 是一款支持本地部署的开源 AI 数字人视频制作工具上传约 10 秒视频克隆形象与声音输入文案即自动出口播片。读完本文你将在本地跑起一条完整的 AI 视频生成流水线全程不依赖云端排队。动手前先核对本地部署环境自检清单 ✅先花 5 秒对照下表任何一项不满足先补齐再开始检查项要求备注操作系统Windows 1019042.1526 及以上或 Ubuntu 22.04 桌面版其他 Linux 发行版未做兼容测试显卡NVIDIA 独显且已安装最新官方驱动三个服务端容器全部占用 NVIDIA 算力核显无法运行内存32GB 及以上16GB 机器 ASR 服务可能起不来磁盘镜像区空余 100GB 以上首次拉取镜像约 70GB 流量磁盘数据区Windows 需 D 盘空余 30GB 以上存放数字人模型与生成作品Node.js18 版本客户端为 Electron 桌面程序DockerWindows 装 Docker DesktopUbuntu 装 docker.io、docker-compose 与 NVIDIA Container Toolkit服务端以容器方式运行驱动装没装、Docker 里 CUDA 容器能不能跑是后面所有步骤的地基这张表就是官方前置条件的浓缩。如果你搜的是 HeyGem 部署教程——没错就是它。项目后来改名为 Duix.Avatar部署流程一致。三步跑通本地部署最小可用环境客户端侧部署很简单源码拉下来装好依赖起窗口。第一步拉取项目代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar克隆下来得到一个 Duix-Avatar 目录后面所有命令都在它里面执行。第二步安装依赖并验证在项目根目录执行npm install装完没有报错即验证通过。install 阶段还会触发 Electron 的 postinstall 安装原生依赖耗时稍长属正常现象。Node 版本不是 18、或中途断网都会在这一步暴露出来失败就重跑同一条命令。第三步首次启动冒烟测试npm run dev预期结果弹出客户端窗口首页有创建视频和创建形象两个入口下方能看到我的作品与我的数字模特列表区。界面打开说明客户端侧已通。第一次生成AI数字人视频跟着做服务端还没有启动下面三步按顺序做。做完第一步本地算力就全部就绪后面客户端只管下指令。任务启动服务端三个容器。在仓库的 deploy 目录执行cd deploy docker-compose up -d预期结果Docker 里出现 duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video 三个容器状态均为 Running。首次拉镜像约 70GB、半小时左右速度取决于网络端口与数据卷的完整配置见 docker-compose.yml。任务克隆你的数字人。打开客户端点右上角创建形象上传一段约 10 秒的视频。预期结果训练完成后我的数字模特里多出一个你的模型首页也能看到对应的头像卡片。视频里必须有你本人清晰的说话声——声音会一并被克隆静音或纯 BGM 的视频会失败。任务生成第一条视频。点创建视频选中刚建好的模特在文本框输入一段文案。预期结果文案先被合成为语音再驱动模特口型进度条走完后作品出现在我的作品里点开即播。模型与作品默认存放在 D 盘 duix_avatar_data 目录这也是数据盘要留 30GB 的原因。只想要口型合成、不需要声音克隆可以改用精简编排 docker-compose-lite.yml只起一个合成容器资源占用更小。功能拆解它还能做什么音频驱动口型。一句话能力跳过文本转语音直接上传现成音频文件模特按音频的节奏和语调对口型。适用场景已有录音的促销播报、给旧视频换人。录一段干净的语音出片口型与语气都会更贴近原声。操作入口创建视频页的音频上传项对应源码 EditUpload.vue。八语言文案。一句话能力文案支持中文、英文、日文、韩文、法文、德文、阿拉伯文、西班牙文。适用场景出海账号口播、同一模特复用到多语言教程。操作入口创建视频的文本输入框直接输入外文即可。本地开放 API。一句话能力Docker 服务起来后本地暴露语音训练与合成18180 端口、视频合成与进度查询8383 端口等接口全部走 127.0.0.1。适用场景把数字人嵌进自己的业务程序、批量生成。接口入参都是 JSON请求示例写在 README 里照着抄就行。操作入口客户端内建的调用逻辑见 model.js 与 video.js。排障与调优卡住时翻这里 症状一up 命令拉镜像失败报错含 request canceled 或 context canceled。原因Docker Hub 官方源连接不稳定。解法给 Docker 配置国内镜像源——Windows 在 Settings 的 Docker Engine 页编辑 JSONLinux 直接改 /etc/docker/daemon.json加上 registry-mirrors 段后点 Apply restart再执行一次 up 命令。症状二新增模特报错克隆形象失败。原因源视频没有声音或声音里没有清晰的人声——声音克隆靠的就是这段人声这也是官方文档里点名的最高频坑之一。解法换一段人在画面中清晰说话的 10 秒视频重新上传建模特。症状三定制模特报 Connection refused。原因ASR 服务启动慢服务端刚拉起还未就绪内存偏小的机器也可能一直没起来。解法在 deploy 目录确认容器状态docker-compose ps三个容器都 Running 后等几分钟再重试克隆。更多案例见 常见问题。到这里你已经从空目录走到本地出片代码、镜像、模特、成片各就各位。想再进一步两个方向——把数字人接进自己的程序服务起来后 18180 与 8383 就是现成的合成管道批量生成不再受界面限制参考 voice.js或者搬家50 系显卡换 docker-compose-5090.yml 起服务Ubuntu 服务器按 README_zh.md 的流程走一遍。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价