ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Duix.Avatar:用一台普通电脑生成数字人视频的完整指南

Duix.Avatar:用一台普通电脑生成数字人视频的完整指南 Duix.Avatar用一台普通电脑生成数字人视频的完整指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar花几万块外包一条数字人口播视频其实你自己那台电脑就能干。Duix.Avatar 是一个完全开源的 AI 数字人本地部署工具录一段 10 秒左右的视频它就能克隆你的形象和声音之后输入文案或上传音频直接生成你出镜口播的视频。内容创作者、做课程的老师、开网店的主播第一次接触照着这套流程也能跑通。这个项目能帮你做什么Duix.Avatar 干的事很简单把你本人变成一个可以反复生成的视频演员。10 秒视频克隆形象和声音全程离线素材不上传文字或音频驱动口型同步脚本支持 8 种语言播报所谓口型同步简单说就是嘴型跟得上说的话是这类工具好不好用的核心它的合成结果就是音视频严格对齐的口播视频。开工前先把环境备好硬件要什么级别先看你的电脑够不够格。官方给的是推荐配置最低一栏是它明确标注的硬性条件项目最低门槛官方推荐CPUi5 级别官方未给最低型号13 代 i5-13400F内存32GB官方标注必要32GB 及以上显卡必须是 NVIDIA 显卡RTX 4070硬盘100GB 空闲100GB 以上Windows 另需 D 盘 30GB注意显卡只认 N 卡项目所有算力都在本地没有 N 卡或驱动没装好后面三个服务根本起不来。AMD 卡目前指望不上。软件装到位了吗以 Windows10 19042 或更高版本为例逐条过一遍没装过 WSLWindows 里跑 Linux 的子系统就先装wsl --install更新 WSL 内核wsl --update去官网下载 Docker DesktopDocker 是把整套服务打包成免安装镜像运行的工具的 Windows 版安装包装完启动首次运行接受协议、跳过登录验证显卡驱动nvidia-smi能打印出显卡信息才算数验证 Dockerdocker --versionC 盘空间不足 100GB 的话Docker 装好后可以在设置里把镜像存储位置挪到别的盘入口在 Settings → Resources → Advanced → Disk image location。从零跑通部署到出片拉代码并起容器先拉项目代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar然后进入仓库的 deploy/ 目录执行docker-compose up -d。这一步会拉三个服务镜像总共约 70GB 流量官方说大概半小时左右速度取决于你的网速建议连 WiFi 干等。机器配置吃紧的话可以改用精简版只有一个服务docker-compose -f docker-compose-lite.yml up -d。如果你是 50 系新显卡30/40 系搭配 CUDA 12.8 也能用这套换配置文件docker-compose -f docker-compose-5090.yml up -d。确认三个服务都活着容器起来了怎么确认没装歪跑一句docker ps完整版应该看到三个容器都是 Running 状态Duix.Avatar-tts语音合成占端口 18180、Duix.Avatar-asr语音识别占端口 10095、Duix.Avatar-gen-video视频渲染占端口 8383lite 版只有一个Duix.Avatar-gen-video。服务端就绪后装客户端去项目官方发布页下载 Windows 安装包双击Duix.Avatar-x.x.x-setup.exe装完即可。建第一个数字人形象打开客户端进创建数字人页面上传一段 10 到 15 秒的正面视频。有个隐藏门槛视频里必须是你本人在清晰说话因为系统要拿这段声音做声音克隆纯画面没声音的素材会直接报错。拍的时候背景简单、光线均匀、脸占画面大一点后面的克隆效果会稳很多。提交后等状态变成完成我的数字人列表里就多了一个你的分身。出第一条视频服务都跑起来了怎么把第一条视频生出来点创建视频选中刚克隆好的形象直接输入文案或上传一段音频提交生成。系统会先合成语音再让形象对口型最后拼成完整视频。文案支持中文、英文、日、韩、法、德、阿拉伯、西语共 8 种语言生成的成品会自动出现在我的作品里下载就能用。再往深里玩一玩装好能干活了还能玩出什么花如果你会写点代码服务端其实把整条流水线都开放成了 API应用程序接口简单说就是让程序之间互相调用的入口全在http://127.0.0.1本地声音克隆先把参考音频放到D:\duix_avatar_data\voice\data调http://127.0.0.1:18180/v1/preprocess_and_tran返回里的asr_format_audio_url和reference_audio_text要记下来语音合成调http://127.0.0.1:18180/v1/invoke带上text和上一步记下的两个字段吐回 wav 音频视频合成调http://127.0.0.1:8383/easy/submit传audio_url、video_url和一个唯一code再用http://127.0.0.1:8383/easy/query?code你的code轮询进度具体参数写法可以看客户端源码里的src/main/service/video.js和voice.js。批量生成一次循环提交多段文案和换背景做系列内容都是在这套接口上套循环就能实现的事这里就不展开了。踩了这些坑就不算白折腾 ⚠️症状docker-compose up -d报registry-1.docker.io连接超时。原因Docker Hub 官方源在国内不稳定。解法给 Docker 配国内镜像源Docker Engine 设置里按官方文档加registry-mirrors后点 Apply restart。症状容器反复重启或根本起不来。原因没装 N 卡或显卡驱动没装对。解法先跑nvidia-smi打不出显卡信息就去更新驱动再来。症状克隆形象时报Connection refused。原因ASR 语音识别服务启动比较慢还没就绪。解法三个服务全 Running 后再等几分钟再提交克隆任务内存只有 16GB 的机器可能压根起不动32GB 是硬门槛。症状新增模特时莫名其妙报错。原因上传的视频没有声音或不是人在说话。解法换一段有清晰人声的素材重新提交。排查时别瞎猜三个服务的运行日志就在 Docker 界面点开对应容器的 Logs 页签里把关键报错复制出来对照 常见问题 文档基本都能定位。一台配得过去的 N 卡电脑加上这套开源数字人方案从克隆到出片全程离线成本就是电费。项目细节和完整 FAQ 都在仓库里的 README_zh.md照着跑今晚你就能拥有自己的数字分身。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表