FEATURED · 精选文章

Duix-Avatar数字人本地部署完整指南:一段10秒视频做出自己的数字人

发布时间 / 2026/9/11 13:12:17
来源 / 创域科博编辑部
栏目 / 资讯中心
Duix-Avatar数字人本地部署完整指南:一段10秒视频做出自己的数字人 Duix-Avatar数字人本地部署完整指南一段10秒视频做出自己的数字人【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix-Avatar 是一款免费开源的数字人克隆工具上传一段约 10 秒的视频即可克隆你的外貌和声音之后输入一句文案就能自动生成口型同步的数字人口播视频全程在本地离线完成不联网、不传数据。如果你想在不把人脸数据交给云端的前提下低成本做出教学、带货、企业内训类的数字人视频这个项目值得上手。先看效果它到底能做出什么样的数字人打开客户端后首页就两个主入口「Create Video」文字直接生成视频和「Create Avatar」上传视频打造数字人下方可以查看「My Works」和「My Avatars」列表。实际流程很直白上传一段 10 秒左右的正面视频系统会自动提取面部特征五官形状、面部轮廓同时用视频里的声音做声音克隆还原语调、语速这些细节。之后你写什么文案数字人就说什么也可以直接上传音频让它按原声的节奏和语调来演。口型匹配是自动完成的不用手动打关键帧。TTS 脚本支持中、英、日、韩、法、德、阿拉伯、西八种语言做多语言内容也很方便。30分钟完成本地部署三步跑通服务端和客户端部署分两部分Docker 服务端干活的算力 客户端操作的界面。先确认硬件必须有 NVIDIA 显卡并装好驱动内存 32G 及以上这是硬性要求硬盘预留 100G 左右空闲空间Windows 下镜像文件默认放 C 盘。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose up -d三条命令之后就去忙别的首次拉取 3 个镜像约消耗 70G 流量需要半小时左右建议连 WiFi 耐心等。当 Docker 里出现 Duix.Avatar-asr、Duix.Avatar-tts、Duix.Avatar-gen-video 三个服务全部 Running服务端就部署完成了。最后一步是安装客户端下载官方构建的安装包双击Duix.Avatar-x.x.x-setup.exe按向导装完即可Linux 用户直接运行 AppImage 文件、免安装。核心能力拆解从克隆形象到批量出片10秒视频克隆数字人。能干什么高精度捕捉外貌特征 声音克隆一次搞定「形」和「声」。怎么用点首页 Create Avatar上传视频等待训练完成成功后形象会出现在 My Avatars 列表里。适合谁想用本人出镜但不想每次重拍的内容创作者、讲师。文字和语音驱动视频生成。能干什么输入文案或上传音频自动生成音视频高度同步的口播视频。怎么用进 Create Video选一个已训练的数字人填文本或传音频即可。适合谁需要批量产出口播内容的电商、教育、企业培训团队——这是把「一次克隆」放大成「持续产片」的核心能力。多模型管理与开放 API。支持导入并管理多个数字人模型不同场景切换不同形象。服务端启动后还会在127.0.0.1暴露本地接口视频合成走 8383 端口/easy/submit提交、/easy/query查进度语音合成走 18180 端口。调用示例代码在 src/main/service/ 下端口与数据目录约定见 src/main/config/config.js。适合谁想跳过客户端、把数字人能力集成进自己系统的开发者。进阶配置compose 文件怎么选、硬件怎么配deploy/ 目录下准备了 4 份 Docker Compose 配置按机器情况挑场景配置文件说明Windows / 标准部署docker-compose.yml3 个服务语音合成 语音识别 视频合成功能最全轻量部署docker-compose-lite.yml只保留视频合成 1 个服务资源占用更低Ubuntu 22.04docker-compose-linux.ymlLinux 客户端用 AppImage 直接运行50 系显卡5090 已验证docker-compose-5090.yml30/40 系卡 cuda12.8 的用户也可用这套硬件基线参考官方推荐配置i5-13400F 32G 内存 RTX 4070。重点提醒内存低于 32G 时部分服务可能起不来16G 机器就有用户踩过 ASR 服务起不来的坑这不是玄学是镜像里的模型本身就吃内存。想榨性能的开发者可以直接调 API 参数如语音合成的temperature、max_new_tokens文档在 README 的「开放 API」一节。数字人部署常见4个坑及排查方法坑1拉镜像失败报net/http: request canceled。现象docker-compose up -d后三个服务全是 Error。原因Docker Hub 官方源连接不稳定。解决在 Docker Desktop → Settings → Docker Engine 里加国内镜像源registry-mirrors后重试。坑2创建模特时报file not exists。现象新增模特时Duix.Avatar-tts 服务日志刷 Rate Exception。原因上传的模特视频必须有真实说话的声音程序要靠它做声音克隆纯画面视频会失败另外 ASR 服务启动较慢服务端刚拉起时先等几分钟再操作。坑3服务死活起不来。现象容器反复重启或无法启动。原因本项目全部算力依赖本地 NVIDIA 显卡没有 N 卡或驱动没装好服务必然起不来。跑一下nvidia-smi能显示显卡信息才算驱动正常nvidia-smi坑4Windows 下 C 盘空间告急。现象Docker 镜像存不下、下载中断。原因WSL 磁盘镜像默认放在 C 盘而项目镜像需要 100G 级空间。解决Docker Desktop → Settings → Resources → Advanced用 Browse 把 Disk image location 改到空闲空间充足的盘。更多问题可查 doc/常见问题.md。提问前建议先自查两件事三个服务是否都是 Running、服务端客户端是否都更新到最新版——项目迭代快不少老问题在新版里已经修掉了。从第一条视频开始Duix-Avatar 目前已支持 Windows 与 Ubuntu 22.04 两套环境社区更新活跃本地部署路线还会继续完善。项目支持全球免费商用用户量超 10 万或年营收达 1000 万美元以上需签署商业许可见 LICENSE。下一步很简单先把三个 Docker 服务拉起来然后对着手机录一段 10 秒的正面说话视频克隆你的第一个数字人。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED — 相关阅读

相关资讯

LATEST — 最新资讯

最新发布

TODAY — 本日精选

新闻

WEEKLY — 本周精选

新闻

MONTHLY — 本月精选

新闻