8G显存离线数字人Duix.Avatar免费部署完整指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar当一段10秒的手机自拍变成由你本人形象口播的成片这就是开源数字人工具的最短路径——Duix.Avatar上传一段10秒视频克隆形象和声音输入文案本地模型合成口播视频全程不联网。这篇文章给你3套部署方案、4个高频坑、一份硬件门槛清单读完10分钟就能判断它适不适合你。为什么不用付费版三条判断定选型这一节解决值不值得花一个周末折腾。对比维度Duix.Avatar本地开源商业云SaaS常见档位定制3D数字人硬件门槛8G显存 32G内存社区实测3060级可用无需GPU但产出受档位限制24G以上显存的工作站授权/制作成本免费商用约¥1万/年或按条计费前期投入高官方README对比3D路线曾高达数十万美元数据走向素材与声纹留在本地磁盘上传云端合成依赖供应商语言覆盖8种语言中英日韩法德阿西看档位一次开发加语言贵自定义程度代码与compose文件全开放仅开放接口参数完全定制我的判断是两条⚠️英伟达显卡 32G内存是一票否决项——全部算力在本地没GPU三个容器起不来16G内存连ASR都可能起不动全离线是必选项——相比云SaaS素材和声纹不出机器这才是选它的理由。每月只出几条片子云档位更划算日更或素材涉密免费商用授权用户量超10万或年营收1000万美元以上的企业需另签协议就是底线优势。技术透视你传的数据到底怎么流这一节解决上传的素材去哪了。服务端是三个Docker容器fun-asr做语音识别、fish-speech做语音合成、duix.avatar做视频合成分别监听本机10095 / 18180 / 8383端口Electron客户端只是调用这些接口的壳。客户端界面很直接左侧作品列表右侧模型列表Create Video和Create Avatar两个入口。最低配置清单低于这条线服务基本起不来英伟达显卡显存8G起步推荐RTX 4070驱动装好且nvidia-smi能识别内存32G16G可能导致ASR服务启动失败磁盘素材目录30G以上默认D:\duix_avatar_dataDocker镜像区100G以上可迁移系统Windows 10 19042或Ubuntu 22.04桌面版网络仅首次拉镜像需要约70G流量、半小时左右之后可断网使用三类人三种用法这一节解决装好之后到底怎么用。内容创作者课程/口播短视频输入10秒出镜口播视频正面、光线充足、背景干净操作客户端Create Avatar克隆形象与声音再Create Video输入文案输出一条口型同步的MP4日更一条没问题以前一节课要约一天棚场地费比物料还贵现在上午窗边拍一段下午数字人就把成片念完了一周三更毫无压力。——一位在社区分享的课程UP主企业运营批量产品短视频输入代言人形象10秒视频 一批产品口播脚本操作克隆一次代言人按脚本列表批量提交合成输出30条以上形象统一的短视频形象与口型不跑偏批量最省心30个SKU各要一条讲解视频数字人形象不变只换文案一个下午全部收工。——一位做消费电子的品牌运营独立开发者接入自有流水线输入HTTP请求三个服务全部在127.0.0.1操作依次调用声纹预处理18180/v1/preprocess_and_tran、文案合成18180/v1/invoke、视频合成8383/easy/submit示例代码在src/main/service/目录输出可编程控制的成片批量与定时任务自己封装接口全在localhost没有鉴权没有计费我包了个批量脚本一晚上渲染了50条。——一位接入本地API的开发者上手三条路Windows一键 / Ubuntu / 50系显卡这一节解决从看到能跑差几步。三条路都在deploy/目录启动区别只是选哪份compose文件。路线AWindows一键推荐首选前提Docker DesktopWSL2与英伟达驱动装好C盘余量不足100G时先到Docker设置 → Resources里把Disk image location改到空间更大的盘下图。cd deploy docker-compose up -d首次拉镜像约30分钟Docker里出现fun-asr / fish-speech / duix.avatar三个服务即成功。想更轻可改用-f docker-compose-lite.yml只起一个视频合成容器。随后从官方Release下载Windows安装包双击安装。路线BUbuntu 22.04轻量前提装好docker.io与nvidia-container-toolkit安装命令见READMEnvidia-smi可见显卡。cd deploy docker-compose -f docker-compose-linux.yml up -d客户端用Release里的AppImage双击即运行免安装root登录桌面时需追加--no-sandbox参数。路线C50系显卡加速面向RTX 5090用户30/40系CUDA 12.8环境也可用使用PyTorch官方预览版cd deploy docker-compose -f docker-compose-5090.yml up -d路线首次启动资源占用适合谁Windows完整版约30分钟拉取70G镜像100G磁盘 / 32G内存主力内容生产机Ubuntu 22.04约30分钟镜像相同同上Linux桌面/开发机50系方案约30分钟镜像相同同上需较新驱动RTX 5090 / CUDA 12.8 避坑手册四个高频报错怎么自查这一节解决出错了先看哪里。Q1docker-compose up -d超时拉取镜像失败ADocker Hub官方源不稳定。打开Docker Desktop → Settings → Docker Engine添加registry-mirrors下图Apply并重启。 验证docker images | grep guiji2025确认fun-asr / fish-speech / duix.avatar三个镜像都在本地。 如果还不行部分镜像源会失效换用最新可用源README里有一组列表重试。Q2克隆形象时报Connection refusedAASR服务fun-asr容器启动慢服务端就绪但ASR未就绪刚启动的头几分钟常见等5分钟重试。 验证docker ps确认三个容器均为Up状态。 如果还不行16G内存可能起不了ASR升级内存或再等久一点重试。Q3新增模特时提示文件/声音无法识别A模特视频里必须有人说话——程序要用音轨做声音克隆无声视频或纯空镜必然失败。 如果还不行检查音频是否落在compose约定的目录默认D:\duix_avatar_data\voice\data以及face2face目录可写。Q4客户端报错日志去哪里拿A客户端点右上角菜单Open Log或到%APPDATA%\heygem.ai\logs\main.log直接取文件服务端在Docker Desktop点开各容器的Logs标签页复制关键行。 验证日志加三容器状态截图基本能分清是环境问题还是数据问题。路线图一句话社区分享的规划指向实时直播驱动与移动端轻量化版本官方持续跟进50系显卡与Ubuntu兼容具体以项目Release更新为准。想动手的话四份材料足够部署配置deploy/ —— Windows完整/轻量、Linux、50系四份compose文件常见问题与自查步骤doc/常见问题.md三个本地API的示例代码src/main/service/授权条款LICENSE —— 免费商用用户量超10万或年营收1000万美元以上需另签协议如果这篇帮你少走了一小时弯路收藏就好。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考