尧图精选

Duix.Avatar 数字人视频本地部署完整指南

🕒 发布时间:2026/9/11 12:51:35 📁 来源:尧图网络
Duix.Avatar 数字人视频本地部署完整指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar本教程面向想在离线环境生成数字人口播视频的你。Duix.Avatar 本地部署后仅需一段约 10 秒的视频即可克隆形象与声音再用文本或音频驱动口型全程无需联网。项目速览Duix.Avatar 是一款支持本地部署与 API 调用的开源数字人工具包。上传约 10 秒视频即可克隆数字人形象与声音输入文本或上传音频自动生成口型匹配的播报视频。常用于课程讲解、产品介绍、形象口播视频的离线制作。环境预检硬性要求与自检方法本节帮你确认硬件是否达标避免部署到一半失败。类别要求说明显卡英伟达显卡且驱动安装正常必要所有算力都在本地内存32G 及以上必要内存过小服务可能启动不了磁盘WindowsD 盘大于 30GC 盘大于 100GC 盘存 Docker 镜像文件磁盘Linux空闲空间大于 100G已验证 Ubuntu 22.04 Desktop系统Windows 10 19042.1526 或 Ubuntu 22.04Windows 需先装好 WSL2 与 Docker运行时Node.js 18、Docker 与 docker-compose源码构建客户端需 Node.js 18可选50 系显卡或 30/40 系 cuda12.8使用 5090 专属 compose 文件自检方法终端执行nvidia-smi能显示显卡型号与驱动版本即达标。Windows 下 C 盘空闲不足 100G 时安装 Docker 后在 Settings → Resources → Advanced 把镜像存储位置改到剩余空间大于 100G 的磁盘。部署流程拉代码、装依赖、启动验证这一节完成服务端与客户端的全部搭建共三步。第一步拉取代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar预期结果目录中出现src/与deploy/子目录。若 clone 中途超时重试或切换网络后重新执行。第二步安装依赖服务端共 3 个 Docker 镜像首次下载约 70G 流量、耗时半小时左右建议先单独拉取docker pull guiji2025/fun-asr docker pull guiji2025/fish-speech-ziming docker pull guiji2025/duix.avatar预期结果docker images列出 3 个镜像。若拉取报连接超时通常是 Docker Hub 网络问题按后文排查。源码构建客户端时先确认 Node.js 18再执行npm install。第三步启动并验证compose 文件位于 deploy/Windows、Linux、5090 各有一份。标准启动cd deploy docker-compose up -d预期结果duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个容器均为 Running 状态lite 版本仅 gen-video 一个服务。客户端执行npm install后npm run dev启动桌面应用也可直接使用官方构建的安装包。若服务不是 Running先执行nvidia-smi确认驱动ASR 服务启动较慢服务起来后等待几分钟再操作。启动后自检清单nvidia-smi能显示显卡信息docker ps中 3 个容器全部 Running客户端首页出现 Create Video 与 Create Avatar 入口功能验证清单启动后按顺序测这 5 项确认链路可用创建形象上传一段约 10 秒、包含人声说话的视频完成形象与声音克隆。文本驱动在客户端输入文本生成口播视频并播放。音频驱动上传音频文件生成视频重点看口型是否对位。多语言脚本支持中、英、日、韩、法、德、阿拉伯、西八种语言任选一种验证合成。API服务端在本地暴露 18180 与 8383 端口通过http://127.0.0.1可调用。常见问题排查本节给出 3 个高频报错的解决方法。docker-compose up -d报 request canceled 或 timeout。 原因Docker Hub 官方源连接不稳定。 解决在 Docker Engine 的 daemon.json 中配置 registry-mirrors 国内镜像源后重启Windows 在 Settings → Docker Engine 修改。定制模特报 Connection refused。 原因ASR 服务启动慢或内存不足16G 可能启动不了。 解决服务启动后等几分钟再克隆内存保证 32G 及以上。创建模特失败提示音频文件不存在。 原因上传的源视频没有声音或没有人在说话。 解决重新上传有人正常说话的视频。性能与资源调优按你的硬件选择 compose 文件即可无需改参数。50 系显卡或 30/40 系 cuda12.8用专属方案cd deploy docker-compose -f docker-compose-5090.yml up -d显存与磁盘紧张时改用 lite 版只启动视频合成一个服务docker-compose -f docker-compose-lite.yml up -d进阶玩法API 串联18180 做音频合成、8383 做视频合成接口写法参考 src/main/service/可自行编排批量生成流程。多模型管理客户端支持导入多个形象模型按任务切换不同数字人。进度轮询视频合成提交后用8383/easy/query按任务 code 查询进度适合写进定时脚本。更新与维护项目更新较频繁服务端与客户端都要同步cd deploy docker-compose up -d # 服务端重新拉取镜像并重启git pull npm run build # 客户端拉取最新代码并重新构建卡住时按 常见问题 中的提问模板整理复现步骤附上客户端日志与 Docker 服务日志到项目社区求助。结语先跑一遍上面的验证清单然后上传一段 10 秒视频生成你的第一条数字人口播视频。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联 返回资讯列表 →