Duix.Avatar数字人本地部署:一段10秒视频克隆形象,30分钟跑通全流程
Duix.Avatar数字人本地部署一段10秒视频克隆形象30分钟跑通全流程【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款免费开源的数字人本地部署工具用一段 10 秒左右的真人视频即可克隆形象和声音输入文案或音频就能生成口播视频。读完这篇你会在 Windows 或 Ubuntu 上把服务端装起来并亲手做出第一条数字人口播视频。为什么值得本地部署面部和声音是最敏感的隐私数据本地部署意味着视频和音频全程不出你的机器不必再担心素材上传后被谁留存。云端数字人普遍按条计费本地方案是一次性硬件投入之后生成多少条都不再花钱。服务端跑起来之后可以完全离线工作没网、内网环境照样能用。部署前硬件与系统清单先对照下面这张表核一遍任何一项不满足都会在部署中途卡住项目要求操作系统Windows 1019042.1526 及以上或 Ubuntu 22.04内核 6.8.0-52-generic磁盘WindowsC 盘空闲 100GB 以上存镜像D 盘空闲 30GB 以上存作品Ubuntu空闲 100GB 以上显卡与驱动NVIDIA 显卡参考配置 RTX 4070必须正确安装驱动本项目全部算力在本地内存32GB 及以上必要16GB 可能起不全服务运行时Docker 与 NVIDIA Container Toolkit源码二次开发需要 Node.js 18Windows 用户如果 C 盘不够 100GB装完 Docker Desktop 后可以在 Settings → Resources 里把镜像存储位置换到空间更大的盘改完记得 Apply部署实操三步走第 1 步拉代码并启动服务端git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose up -d首次启动要拉取约 70GB 镜像预计半小时左右建议连 WiFi。预期结果Docker 里出现 3 个 Running 状态的服务tts、asr、gen-videolite 轻量版只有 1 个视频生成服务。Ubuntu 机器先把 Docker 和显卡运行时装好再换成 Linux 专属的编排文件sudo apt update sudo apt install docker.io docker-compose nvidia-container-toolkit sudo nvidia-ctk runtime configure --runtimedocker sudo systemctl restart docker cd Duix-Avatar/deploy docker-compose -f docker-compose-linux.yml up -d预期结果nvidia-smi能显示显卡信息Docker 里 3 个服务全部 Running。拉镜像慢的话可按 doc/常见问题.md 里的方法给 Docker 配置国内镜像源。第 2 步装客户端到项目 Release 页面下载对应系统的客户端安装包Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 下载 AppImage双击直接运行root 用户下需执行./Duix.Avatar-x.x.x.AppImage --no-sandbox。预期结果客户端启动后能自动连上本地服务主界面正常显示。第 3 步做一次完整验证新建一个数字人上传 10 秒左右、人在说话的正面视频再用一段文案生成视频。预期结果等待片刻后拿到一条口型对得上的口播视频这条视频就是整个系统打通的证明。核心功能上手主界面就两个入口和两个列表点左上Create VideoAI 视频生成器选一个已建好的数字人输入文案或上传音频提交后得到一条口播视频。点右上Create Avatar上传 10 秒左右的视频程序同时克隆形象和声音得到一个数字人。My Works / My Avatars分别管理已生成的视频作品和已克隆的数字人支持搜索和分页。右上角齿轮进设置查用户协议、打开客户端日志排障靠它、中英文切换。Windows 上生成的素材统一存在D:\duix_avatar_data下Ubuntu 在用户主目录的duix_avatar_data路径可在 deploy/docker-compose.yml 的 volumes 里改。脚本口播支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语共 8 种语言。进阶API 接入服务端跑起来后本地暴露了模特训练http://127.0.0.1:18180/v1/preprocess_and_tran、音频合成http://127.0.0.1:18180/v1/invoke和视频合成http://127.0.0.1:8383/easy/submit三类接口可以串成一条无人值守的流水线。最常用的就是视频合成最小请求如下curl -X POST http://127.0.0.1:8383/easy/submit -H Content-Type: application/json \ -d {audio_url:/path/audio.wav,video_url:/path/video.mp4,code:task-001}预期结果提交成功返回的 code 用来查进度GEThttp://127.0.0.1:8383/easy/query?codetask-001返回 Running 到 Success 即合成完成。完整调用示例可以直接读 src/main/service/video.js 和 src/main/service/model.js。避坑速查现象可能原因一句话解决docker-compose up -d拉镜像超时Docker Hub 连接不稳定按 doc/常见问题.md 配置国内镜像源克隆形象报 Connection refusedasr 服务启动慢刚拉起就操作了服务端起来后等几分钟再克隆内存 16G 可能直接起不来新建模特报错、视频不通过上传的视频没有声音用 10 秒左右、人在说话的带声视频三个服务起不来、GPU 占用为 0没有 N 卡或驱动没装好跑nvidia-smi验证装好 NVIDIA 驱动再来容器反复重启或报文件错误数据目录没建好、C 盘塞满提前建好D:\duix_avatar_data把 Docker 镜像存储挪到空间充足的盘排障时先看客户端日志再点进对应容器看 Logsfile not exists这类报错基本都指向路径配置谁适合用它自媒体与个人创作者批量产出口播、带货短视频形象声音全可控。电商团队用固定数字人讲商品随时换文案不用重拍。企业与培训部门把标准课程做成数字人讲解视频内部流转不涉及外发。需要把模型训练和视频合成接进自己产品的开发者三个本地接口直接可调用。对数据出境、素材留存敏感的团队整条链路在本地闭环。结尾一句话挑一台带 N 卡的电脑按上面三步把服务跑起来先拿 10 秒视频试一次克隆第一条口播视频出来之后后面就都是复制粘贴的事。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联
返回资讯列表 →