本地部署 Duix.Avatar:一段10秒视频,免费生成你的数字人口播视频
本地部署 Duix.Avatar一段10秒视频免费生成你的数字人口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar你手机里存着一段10秒的自拍以前它只能当朋友圈素材。把它交给 Duix.Avatar就能从这个片段克隆出一个数字你——脸和声音都克隆之后输入任意文案数字人替你出镜念稿产出一条口播视频。整个流程完全离线你的视频和声音数据不用离开电脑。⚖️ 之前 vs 现在数字人视频的两种做法做数字人视频以前基本只有云端服务一条路注册、充值素材传到第三方服务器费用按视频分钟数或包月计。更大的隐患是你的形象和声音数据全程不在自己手里。Duix.Avatar 把形象克隆、声音克隆、视频合成这整条链路搬到你自己的机器上——Docker 拉起三个本地服务跑起来之后不需要联网。云端数字人服务Duix.Avatar 本地部署费用按分钟计费或包月订阅一次部署之后免费用数据视频音频上传第三方服务器全程离线素材不出本机 快速上手本地部署最小步骤环境检查支持 Windows 1019042.1526 以上或 Ubuntu 22.04 桌面版。唯一的硬条件是 NVIDIA 独显且驱动装对因为全部算力都在本地跑nvidia-smi # 能显示显卡信息 驱动正常否则先去装驱动空间方面数据盘Windows 下是 D 盘要留 30GB 以上存模型和作品镜像目录默认在 C 盘需要 100GB 空闲。安装依赖Windows 用户先确认 WSL 状态并更新然后从官网装 Docker Desktopwsl --list --verbose # 能列出发行版 已安装 WSL wsl --update # 把 WSL 更新到最新版Docker Desktop 首次启动接受协议、跳过登录即可。C 盘不足 100GB 的话进 Docker Desktop → Settings → Resources → Advanced把 Disk image location 改到别的盘上剩余空间大于 100GB 的目录Ubuntu 用户装 Docker 和 NVIDIA 容器工具链sudo apt update sudo apt install docker.io docker-compose # 安装 Docker sudo apt-get install -y nvidia-container-toolkit # 让 Docker 能调 GPU sudo nvidia-ctk runtime configure --runtimedocker sudo systemctl restart docker拉取代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy # 部署配置都在 deploy 目录启动服务# Windows 默认声音合成/语音识别/视频合成三个服务 docker-compose up -d # lite 版只跑视频合成适合只想出视频、不做克隆的场景 docker-compose -f docker-compose-lite.yml up -d # Ubuntu docker-compose -f docker-compose-linux.yml up -d # NVIDIA 50 系显卡5090 已验证 docker-compose -f docker-compose-5090.yml up -d首次拉镜像大约 70GB 流量连上 WiFi 等半小时左右没动静别以为卡死了。验证成功docker ps # 看容器状态成功标志duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个容器全部 running没有 Restarting。lite 版只有一个 gen-video 容器起来就算成功。安装客户端客户端是 Electron 桌面程序从项目 Releases 页下载官方安装包即可Windows 是 exeUbuntu 是 AppImage下载地址见仓库 README。装好后双击启动它默认连本机的127.0.0.1:8383和127.0.0.1:18180不用额外配置。想自己从源码构建也行需要 Nodejs 18执行npm install后npm run build:win。 核心能力拆解克隆、口播、API克隆数字形象10秒视频换一张脸一句话定义上传一段说话的片段系统同时从画面里训练脸部模型、从音轨里训练声音模型。打开客户端点右上角Create Avatar选择一段正面人物说话的短视频10 秒左右即可上传等训练完成My Avatars列表里出现新模型关键限制片段必须包含人在说话的音轨声音克隆用的就是这段音频纯无声视频会直接失败。人脸正面、光线充足、不被遮挡画质越清楚越好。文字驱动口播文案进视频出一句话定义输入文案或上传音频系统先用克隆的音色合成语音再自动驱动模型对口型产出完整口播视频。首页点Create Video选一个已训练好的模型两种输入方式直接输入文案系统先做文本转语音或上传一段成品音频模型跟着你的原声对口型提交后等合成结束成片出现在My Works里关键参数文案支持中、英、日、韩、法、德、阿拉伯、西语共 8 种语言。它做的是非实时合成脚本越长等待越久批量需求建议走下面的 API。本地 API把合成能力接进自己的工作流一句话定义Docker 服务起来后就在本地暴露了端口模型训练、语音合成、视频合成都能用 HTTP 调用不用点界面。声音训练http://127.0.0.1:18180/v1/preprocess_and_tran语音合成文本转语音http://127.0.0.1:18180/v1/invoke视频合成http://127.0.0.1:8383/easy/submit配合http://127.0.0.1:8383/easy/query?codexxx轮询进度各接口的完整请求参数见仓库 README 的开放 API章节客户端的调用写法可以直接参考src/main/service/下的 model.js、video.js、voice.js。 硬件与性能预期32G 内存是硬门槛README 把内存 32G 标成了必要项显卡只给了推荐配置、没给明确下限所以建议直接按推荐配置对照最低配置能跑通i5 级 CPU10 代及以上、32GB 内存、NVIDIA 独显nvidia-smi可查、数据盘 30GB 以上 镜像目录 100GB 空闲舒适配置不折腾13 代 i5-13400F 及以上、32GB 以上内存、RTX 4070 级别及以上显卡如果你的配置卡在中间先跑通再说体验会打折但不会崩。显存吃紧可以先用 lite 版 compose 文件只拉起视频合成服务看速度能不能接受。⚠️ 避坑指南三个最高频的坑拉镜像超时up -d 报连接错误现象docker-compose up -d后接连报request canceled while waiting for connection原因Docker Hub 官方源连接不稳定解法Docker Desktop → Settings → Docker Engine在 JSON 里加registry-mirrors配置国内镜像源镜像源列表见官方常见问题文档Apply restart或者换稳定的代理网络再重新执行docker-compose up -d新增模特秒失败现象上传视频点创建模特很快报错原因片段里没有人在说话的音轨——声音克隆依赖这段音频缺了它整个流程跑不下去解法重录一段说话清晰连续的 10 秒以上片段重新上传训练定制模特报 Connection refused现象训练时日志出现建立funasr连接异常[Errno 111] Connection refused原因ASR 服务语音识别启动较慢点得太早它还在校验阶段内存只有 16G 的话也可能根本起不来解法等三个服务全部 Up 之后再等几分钟做克隆操作仍然报错就逐个打开容器日志页定位是哪个服务的问题 进阶与扩展方向API 接入本地 18180/8383 端口用脚本调用批量出片接到自己的内容生产流水线里lite 部署docker-compose-lite.yml只启动视频合成服务省资源适合已有模型只做出片的场景50 系显卡换docker-compose-5090.yml启动30/40 系 CUDA 12.8 用户也能用这套方案生态项目在 Coze 平台也有克隆智能体和插件云端版不用本地部署部署遇到问题先翻 issue 区和 doc/常见问题.md收尾现在打开 Docker 页面确认三个服务都是 Running然后启动客户端选一段带声音的 10 秒片段点 Create Avatar去倒杯水——回来模型就该训完了。再把你今天要发的文案敲进去交给它就行。 资源链接代码仓库clone 地址git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar中文文档入口README_zh.md常见问题doc/常见问题.md部署配置deploy/Windows / lite / Linux / 5090 四套 compose服务接口实现src/main/service/model.js / video.js / voice.js【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联
返回资讯列表 →