资讯动态

HeyGem.ai 本地部署:从零搭起数字人视频生成,素材不出门

发布时间:2026/9/11 6:01:08 来源:尧图企业网站定制
HeyGem.ai 本地部署从零搭起数字人视频生成素材不出门【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar公司合同、内部培训、客户演示——这些场景里把脸和声音交给第三方 AI 平台并不现实。HeyGem.ai 是一个可以完全离线跑的 AI 视频生成平台上传一段约 10 秒的真人视频完成克隆之后用文字或语音驱动这个数字人就能自动产出对口型的视频。整个过程不联网素材和数据都留在你自己的硬盘里。适合做口播内容的创作者也适合对数据敏感的团队。 一键启动 HeyGem.ai 的 3 个前置条件先确认三件事Node.js 18、能跑的 NVIDIA 驱动、Docker。客户端是 Electron 应用服务端是三个 GPU 容器缺任何一件都起不来。命令行执行node -v确认是 18.x执行nvidia-smi能看到显卡型号说明驱动正常——这一步最关键项目所有算力都在本地 GPU 上Windows 上装 Docker Desktop 前建议先执行wsl --update把 WSL 更新到位。 Docker 部署 HeyGem.ai 的最快路径客户端和服务端分开装服务端一条命令拉起。克隆代码后装依赖、启动客户端git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai npm install npm run dev服务端配置放在deploy/目录进入后执行docker-compose up -d首次拉取三个镜像要消耗约 70GB 流量预留半小时。当 Docker 里三个服务全部变成 Running且npm run dev弹出的桌面窗口能正常打开就表示本地部署 HeyGem.ai 成功了。 从一段 10 秒视频到成片HeyGem.ai 视频制作教程主线四步传素材 → 训角色 → 给文案 → 出视频。上传素材一段 10 秒左右、人物正面出镜且正在清晰讲话的视频。画面决定形象克隆质量音轨会被拆出来做声音克隆所以视频必须带人声。创建数字角色提交后客户端会调用 ASR 和 TTS 服务训练形象与声音产物落在D:\duix_avatar_data\face2face目录Linux 在用户主目录同名文件夹。输入文案或语音在编辑页直接贴文字或上传现成的音频文件两种方式都能驱动角色。生成视频提交后走视频合成服务客户端轮询进度完成后直接在作品列表里播放、导出。⚡ GPU、内存、磁盘资源怎么配才不白跑推荐基线32GB 内存 RTX 4070 级别显卡 100GB 以上空闲磁盘。方案服务数适用场景完整版docker-compose.yml3 个ASR / TTS / 视频生成要克隆声音、完整功能Lite 版docker-compose-lite.yml1 个仅视频生成已有音频只跑对口型50 系显卡docker-compose-5090.yml3 个CUDA 12.8 预览版RTX 50 系新卡配置文件里视频服务已设置shm_size: 8g小内存机器不要照搬NVIDIA_VISIBLE_DEVICES0指定用哪块卡多卡机器按需改数据目录建议放本地机械盘或 SSD 分区避免放在网盘映射路径上拖慢读写。 进阶玩法声音克隆、八语言与批量接口自定义语音模型克隆效果取决于参考音频重录一段语速平稳、环境安静、时长更长的素材再训练比调参数更有效。多语言脚本文案支持中、英、日、韩、法、德、阿拉伯、西八种语言直接切语言输入即可。批量生产客户端启动后开放了训练与合成 API8383、18180 端口接口调用方式可以参考 src/main/service/ 下的model.js、voice.js、video.js把它接进脚本就能批量出片。️ 三个高频坑按现象对号入座docker-compose up -d卡在拉镜像报request canceled、超时——Docker Hub 官方源连接不稳定。解法在 Docker 的 daemon.json 里配置registry-mirrors国内镜像源重启 Docker 再拉。新增模特直接报错训练失败——素材视频没有声音或没人说话。声音克隆依赖视频音轨换一段人在清晰讲话的视频重录即可参考 常见问题文档。定制模特报Connection refusedfunasr 连接异常——ASR 服务启动慢或系统内存不足 32GB 根本没拉起来。等服务全部 Running 后等几分钟再提交内存不够就换机器这个报错靠重试解决不了。至此HeyGem.ai 本地部署的路径就一条显卡驱动 → 三个服务 → 十秒素材 → 出片。脸和声音素材全程不出内网这正是换掉第三方平台的全部理由。先执行一次nvidia-smi通了就动手。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价