ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

HeyGem.ai 本地部署完全指南:10 秒视频克隆数字人,离线生成口播视频

HeyGem.ai 本地部署完全指南:10 秒视频克隆数字人,离线生成口播视频 HeyGem.ai 本地部署完全指南10 秒视频克隆数字人离线生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarHeyGem.aiDuix.Avatar是一套能在本地完整部署的开源数字人视频生成工具适合想批量产口播视频的自媒体人和内容团队全程离线素材和成片都不出这台机器。部署完成后你只需上传一段 10 秒左右、带清晰人声的视频它就能克隆出你的形象和声音之后输入一段文案或传一个音频文件自动产出嘴型对得上的播报视频。 HeyGem.ai 数字人视频生成工具是什么它是个组合一个 Electron 桌面客户端加一组跑在 Docker 里的本地算力服务。客户端只负责界面和任务编排语音识别、语音合成、视频合成这些重活分别装在 3 个容器里全部走 127.0.0.1 的内网端口机器不联网也能干活。能力速览10 秒视频克隆形象与声音 文案/音频驱动口播视频 全程离线 8 种语言文案 开放本地 API克隆、驱动、合成这些环节不单独展开下面放到主流程里按步骤讲。 本地部署前检查清单硬件、软件与网络显卡必须 NVIDIA 且驱动装好——命令行跑nvidia-smi能打显卡型号和显存即合格。内存32G 起——16G 的机器 ASR 服务可能直接起不来。磁盘装镜像的盘Windows 默认 C 盘留 100G 以上空余存模型和作品的盘留 30G 以上。系统Windows 10 19042 以上或 Ubuntu 22.04其他 Linux 版本未验证。DockerWindows 需先有 WSL2 和 Docker DesktopLinux 跑docker --version有版本号即可。网络首次拉镜像约 70G 流量用 WiFi 更稳拉不动的解法在出问题怎么办一节。Node.js仅源码跑客户端时需要18 版本。C 盘不够 100G 时Docker 装完后可以在 设置 → Resources → Disk image location 把镜像目录挪到空间大的盘 部署路径怎么选直装客户端还是源码跑先定路线再看命令你的情况客户端服务端只用不碰代码仓库 Releases 的官方安装包完整版docker-compose.yml3 个服务要改客户端 / 参与开发源码 npm 跑同上显存内存吃紧8G 显存左右同上lite 版只起 1 个容器NVIDIA 50 系显卡如 5090同上docker-compose-5090.ymlUbuntu 22.04AppImage 双击即用docker-compose-linux.yml客户端源码路线git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai npm install npm run dev装完依赖后npm run dev会弹出桌面窗口没弹就先回看npm install有没有原生模块编译报错Node 版本不对是常见原因。客户端安装包路线从仓库 Releases 页面下对应系统版本Windows 是 setup.exe 双击安装Linux 是 AppImage 双击即用不占源码环境。服务端容器路线cd deploy docker-compose up -d开始下载 3 个镜像约 70G、半小时上下网速决定时长。显存内存吃紧换 lite 版docker-compose -f docker-compose-lite.yml up -d只起视频合成这 1 个容器流量小很多。各平台对应的 compose 文件都放在 deploy/ 目录里按上表选。 从启动到第一条成片四个里程碑里程碑 1三个服务全部 Running做什么服务端命令跑完后打开 Docker Desktop 看容器列表。成功标志Duix.Avatar-asr、Duix.Avatar-tts、Duix.Avatar-gen-video 状态都是 Runninglite 版只有 gen-video 一个。有任何一个不在 Running直接跳到下一节。里程碑 2客户端窗口打开并连上服务端做什么npm run dev或启动安装包。成功标志主界面出现创建视频和快速定制数字人两个入口卡片下方我的作品 / 我的数字模特列表正常加载不是一直转圈。里程碑 3克隆出第一个数字人做什么点快速定制数字人上传一段 10 秒左右、正对镜头、人声清晰的视频等克隆流程跑完。成功标志数字人列表里出现这张形象卡片点开能预览原视频。里程碑 4生成第一条视频做什么点创建视频选中刚建的数字人输入文案或上传音频文件提交。成功标志作品列表多一条新视频播放时嘴型跟读音对得上。️ 容器起不来、克隆报错怎么查执行 docker-compose up -d 报registry-1.docker.io ... request canceled拉不动镜像现象三个服务全报错卡在拉取阶段。原因到 Docker Hub 的链路不稳。解法给 Docker 引擎配国内镜像源或开全局代理再重新 up。容器起不来、反复重启现象容器状态不是 Running或一直 Restarting。原因本机没有 NVIDIA 显卡或驱动没装好——项目算力全在本地没有 NVIDIA 就跑不了。解法先跑nvidia-smi打不出显卡信息就先修驱动。创建数字人时直接报错现象上传视频后克隆失败。原因视频里没有声音或声音不是人说话。解法换一段有清晰人声的素材重传。克隆时报Connection refused现象服务端日志里连不上 ASR 服务。原因ASR 容器启动慢或内存只有 16G 根本起不来。解法服务端全部 Running 后等几分钟再操作内存不够先加内存。想查日志不知道去哪现象出错了但没留证据没法继续排查。原因客户端和服务端的日志入口不显眼。解法客户端在右上角设置菜单点打开日志看 logs 目录里的 main.log服务端在 Docker 里点开对应容器Logs 页复制内容。⚙️ 把成片效果调得更好按场景排查画面发糊先查什么源视频分辨率低于 1080p 的素材换掉输出别超过源分辨率。拍摄条件光线足、正对镜头、背景干净——重录一段 10 秒素材比调参数有效。口型或声音不像先查什么源视频里的人声有没有背景噪音有就重录。文案里大段数字、缩写、中英夹杂会拉低相似度拆成短句再提交。生成慢或卡住先查什么三个容器是否都 RunningASR 起得慢服务端刚起来先等几分钟。同时只跑一个生成任务显存紧张就换 lite 版或降输出分辨率。磁盘快满了怎么办镜像目录挪到空间大的盘Docker 设置 → Resources → Disk image location。清掉数据目录里废弃的作品和中间文件。报错对不上号时带着客户端 main.log 和容器日志去常见问题对照截图排查要把数字人能力接进自己的系统按 README_zh.md 的开放 API 一节从本地 127.0.0.1:8383 的端口开始调。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进