ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Duix-Avatar 本地部署:3 步拥有你的 AI 数字人口播视频

Duix-Avatar 本地部署:3 步拥有你的 AI 数字人口播视频 Duix-Avatar 本地部署3 步拥有你的 AI 数字人口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix-Avatar 是一款完全开源、全离线运行的数字人合成工具拍一段 10 秒左右的视频就能克隆你的长相和声音之后输入文案或上传音频它会自动生成数字人口播视频。所有处理都在本地部署的机器上完成形象与声音数据不出本机成本低、隐私安全。电脑满足配置的话从零到出片大约一小时内能跑完。 效果速览10 秒视频克隆你的数字人Duix-Avatar 用一段 10 秒左右的真人视频就能克隆出你的数字人形象和声音不需要摄影棚、不需要设备。克隆完成后输入一段文案先转成语音再做口型同步——口型同步 ≈ 给数字人对嘴型配音或者直接上传现成音频都能驱动口播视频输出。它最大的卖点有三点全离线本地处理数据和隐私不出机器10 秒素材即可克隆零门槛完全开源出片边际成本趋近于零个人和小团队都用得起。✅ 硬件自检清单动手前确认 5 件事检查项最低门槛系统Windows 1019042.1526或 Ubuntu 22.04 DesktopCPU第 13 代英特尔酷睿 i5-13400F 或更高内存32GB 及以上显卡NVIDIA RTX 4070 或更高已装驱动磁盘WindowsC 盘 100G、D 盘 30GUbuntu空闲 130G必须是 NVIDIA 显卡。项目依赖 CUDA 加速计算AMD 或核显连服务都起不来。跑一下nvidia-smi能看到显卡信息说明驱动没问题报错就先修驱动。C 盘空间不够时装完 Docker 可以在设置里把镜像存储位置挪到别的分区Settings → Resources → Disk image location 部署实操把数字人服务跑起来的三步整个数字人本地部署链路分四块客户端 三个 Docker 服务语音识别、语音合成、视频生成。客户端负责界面和调度三个服务负责算力安装 WSL 与 DockerWindows 机器先看看 WSL 装没装没装就装一次网络不稳定多试几次很正常wsl --list --verbose wsl --install wsl --update安装过程会要求设置用户名和密码设置后记住它。然后从官网下载 Docker Windows 版按引导安装首次启动接受协议、跳过登录任务栏托盘图标显示 Running 就对了。Ubuntu 用户不用 WSL直接装 Docker并先装好 NVIDIA 驱动、用nvidia-smi确认sudo apt update sudo apt install docker.io docker-compose环境搭好接下来把服务拉起来。拉取服务镜像并启动容器先获取项目代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar三个服务的镜像都不小分开先拉比让 compose 自动拉更稳首次拉取约 70G 流量看网速等半小时上下docker pull guiji2025/fun-asr docker pull guiji2025/fish-speech-ziming docker pull guiji2025/duix.avatar然后进 deploy 目录一条命令启动compose 配置就放在仓库的 deploy 目录里cd deploy docker-compose up -d两种变体50 系显卡如 5090用docker-compose -f docker-compose-5090.yml up -d低配机器用 lite 版docker-compose-lite.yml少一个服务Ubuntu 用docker-compose-linux.yml。启动后在 Docker 的容器列表里确认三个服务都是 Running安装客户端并首次验证到项目的发布页下载官方构建的安装包Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 下载 AppImage 双击直接运行root 用户需在终端加--no-sandbox参数启动。首次启动接受协议后进入主界面。首页能看到Create Video和Create Avatar两个入口卡片、下方是作品与形象列表说明首次验证通过部署完成。接下来做第一个数字人视频。 从零创作到出片素材到成片的三步走第一步备素材正面出镜、背景简单、光线充足10~15 秒分辨率 720p 以上面部清晰、表情自然带一点头部转动必须有人声程序要用这段声音做声音克隆静音视频跑不通第二步训练模型在客户端点Create Avatar入口创建数字人上传素材视频填写模型名称选择性别和年龄段以实际界面为准点对应按钮开始训练等大约 5~10 分钟第三步生成口播视频在My Avatars列表选中训练好的数字人输入台词建议先从 50 字以内开始或上传现成音频选好语速、语调等语音参数点生成等 3~5 分钟成片会出现在My Works列表里直接下载就能发布。想再精致一点四条进阶建议拍摄绿幕背景拍后期换背景方便头部保持稳定音频无杂音参数面部检测不准时可在客户端用户侧配置文件中微调人脸检测相关参数以实际界面选项为准批量服务启动后本地会开放端口18180 语音合成、8383 视频合成脚本调用 API 即可批量出片后期加背景音乐和字幕调亮度与转场成片质感立刻不一样️ 排错与调优常见问题速查表出问题按这个顺序查三个服务是否都 Running → NVIDIA 驱动是否正确 → 客户端和服务端是否最新版。现象可能原因处理办法拉镜像失败、连接超时Docker Hub 官方源不稳定Docker Engine 里配置国内镜像源后重启再重新执行服务起不来、容器反复重启NVIDIA 驱动未装或版本不符安装/更新 NVIDIA 驱动nvidia-smi验证后再试18180 / 8383 端口被占用其他程序占用了端口找到并关闭占用程序重新docker-compose up -d训练报 Connection refusedASR 服务启动慢还没就绪服务启动后等几分钟再训练内存需保证 32G创建模型失败、提示音频相关素材视频里没有人说话的声音重拍一段有真人声音的视频客户端连不上服务容器不是 Running 或版本过旧检查容器状态服务端客户端都更新到最新拉镜像超时是最常见的第一个坑。在 Docker Desktop 打开 Docker Engine 设置页在 JSON 里配上国内镜像源镜像源会随时间失效自行搜索最新的点 Apply restart 即可要深挖问题就看日志。客户端日志在右上角设置菜单里Open Log打开以实际界面为准服务端日志则在 Docker 里打开对应容器从 Logs 标签页查看并复制比如语音合成服务的日志性能方面下面三档参数供你调整自己侧生成的配置文件时参考按硬件对号入座低配i5 32G RTX 4070{ render_quality: medium, face_detail_level: 2, batch_size: 1, max_threads: 4 }中配i7 64G RTX 4080{ render_quality: high, face_detail_level: 3, batch_size: 2, max_threads: 8 }高配i9 128G RTX 4090{ render_quality: ultra, face_detail_level: 4, batch_size: 4, max_threads: 16 }写在最后无论是在线教育、内容创作还是企业宣传数字人口播视频都能用它做出来从克隆到出片的全流程留在自己的电脑上素材和作品本地存储隐私和成本都兜住了。现在就可以拍一段 10 秒的视频开始你的第一个数字人离你只有一个下午。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表