资讯动态

Duix.Avatar:装好就能跑的开源数字人,10秒视频克隆出会说你话的口播视频

发布时间:2026/9/11 6:54:12 来源:尧图企业网站定制
Duix.Avatar装好就能跑的开源数字人10秒视频克隆出会说你话的口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想在自己电脑上做一个会说话的数字人又不想把脸和声音传到云端Duix.Avatar 就是这么一款开源的离线数字人工具丢进一段10秒左右的人像视频它就能克隆出你的形象和声音之后输入文案或音频直接在本机生成一条口型对齐的口播视频。它是怎么工作的客户端只是个外壳真正干活的是本地跑起来的三个 Docker 服务一个把视频里的话转成文字ASR一个用你的声音把新文案读出来TTS一个负责把形象和声音合成并对齐口型。桌面端只负责把文件递过去、把结果接回来所以数据不出本机隐私这块你不用操心。第一次运行环境门槛是这套工具最容易被劝退的地方先看清楚再动手Windows 1019042 以上或 Ubuntu 22.04一块英伟达显卡加驱动32G 内存C 盘留 100G 以上放镜像、D 盘 30G 以上放作品。满足了就按这个顺序来装好 WSL 和 Docker Desktop首次运行接受协议、跳过登录。进项目 deploy 目录按 compose 文件拉起服务端第一次会拉大概 70G 镜像等半小时左右看到 asr、tts、gen-video 三个容器都 Running 就成了。去 releases 下载对应系统的客户端安装包Windows 双击 .exeLinux 直接跑 .AppImage不用额外安装。启动后就是这个主界面Create Video 出片Create Avatar 上传视频克隆数字人下面 My Works 和 My Avatars 分别存你的成片和你的形象。克隆完之后能做什么形象存进 My Avatars 之后后面就是反复出片选一个数字人把要播报的文案贴进去点生成几分钟后 My Works 里就多一条成片能直接播放、导出。文案支持八种语言同一个数字人今天念中文、明天念英文都行右上角设置里能切界面和口播语言不用换模型。想更自动化也可以走它开放的本机 API模特训练、音频合成、视频合成各是一个本地端口脚本里按顺序调用就行适合批量出片或接到自己的流程里。数字人本地部署的几个配置项数据目录默认作品和模型都落在 D 盘 duix_avatar_data 下挂载路径写在镜像里换盘要先改 compose 里的挂载否则服务找不到你的文件。Docker 镜像位置C 盘放不下 100G 镜像的话在 Docker 资源设置里把镜像位置 Browse 到别的盘再重启能省很多事。国内镜像源拉镜像卡死基本是官方源慢在 Docker 的 daemon 配置里加 registry-mirrors 指向国内源重新拉一次就好。compose 选择显存小就起 lite 版只跑合成那一个服务50 系显卡用专门的 5090 那份别用错。本地部署卡住了怎么办三个容器没全 Running先确认有英伟达显卡、驱动装对了没有 GPU 这三个服务根本起不来这也是最常见的原因。克隆形象报 Connection refusedASR 那个服务启动慢服务端起来后等几分钟再操作内存只有 16G 的机器可能直接起不来。新增模特报错用来克隆的视频必须有人声、且是人在说话纯无声视频会让声音克隆失败。使用边界克隆形象和声音前最好只用本人或已拿到授权的素材涉及别人肖像和声音的地方要合规。开源版全球免费商用但用户量过 10 万或年营收过千万美元的企业需要另签商业许可用的时候留意一下自己的量级。适合想在自己机器上私有化出数字人口播的人创作者、做课件口播的或者只是不想把素材上云的个人。部署和使用的具体问题先翻一遍 常见问题再看 官方 README没解决就去仓库提 issue提问前记得把日志带上。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价