ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

免费生成本地AI数字人视频:Duix.Avatar 数字人克隆完整上手指南

免费生成本地AI数字人视频:Duix.Avatar 数字人克隆完整上手指南 免费生成本地AI数字人视频Duix.Avatar 数字人克隆完整上手指南【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar你需要制作口播视频时外包很贵在线工具又担心数据隐私。Duix.Avatar 是一个免费开源的本地 AI 数字人视频生成工具上传一段约 10 秒的视频即可克隆你的形象和声音再输入文案或音频就能离线生成数字人口播视频全程不需要联网。 快速了解一段 10 秒视频生成你的数字人Duix.Avatar 由 Duix.com 开源分两部分服务端Docker 部署负责形象训练、声音克隆、视频合成全部在本地 GPU 上运行客户端桌面图形界面Windows / Ubuntu 22.04用来上传素材、填写文案、查看作品输入是一段 10 秒左右的真人视频输出是带口型、配你声音的播报视频。适合这些场景个人口播内容批量制作、课程录播、企业内部宣传视频且素材不出本机。 跑起来Docker 三步部署本地服务先确认硬件达标NVIDIA 显卡驱动装好nvidia-smi能看到显卡是硬性要求官方推荐 i5-13400F 32GB 内存 RTX 4070Windows 要求 D 盘空余 30GB 以上、C 盘 100GB 以上Ubuntu 要求硬盘空余 100GB 以上。git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar执行后会把整个项目下载到本地包含客户端源码和deploy/部署目录。Windows 需要先装好 Docker Desktop首次下载约 70GB 流量预留半小时Ubuntu 用sudo apt install docker.io docker-compose安装。然后在部署目录启动服务cd deploy docker-compose up -d执行后 Docker 会拉取 3 个镜像ASR、TTS、视频合成并在后台启动看到三个容器都是 Running 状态即成功lite 精简版只有 1 个服务Duix.Avatar-gen-video。客户端直接用官方构建的安装包Windows 双击Duix.Avatar-x.x.x-setup.exe安装Ubuntu 双击Duix.Avatar-x.x.x.AppImage启动。 用一次克隆数字人并生成第一条视频输入素材准备一段自拍视频时长至少 8 秒分辨率 720P 以上格式 MP4/MOV全程只有你一个人五官清晰不遮挡、吐字清晰。视频里的声音会被用来克隆音色所以必须带人声。定制模特打开客户端点击首页的「Create Avatar / 创建模特」上传视频、填写模特名称提交后系统开始本地训练状态显示「训练中」完成后出现在「My Avatars」列表里。写文案点击「Create Video / 创建视频」选择刚做好的模特在文本框输入内容支持中英文脚本支持英语、日语、中文等 8 种语言或者上传一段音频mp3/wav/flac/m4a不超过 30 分钟然后点击「合成视频」。查看输出到「My Works / 我的作品」查看进度状态变为完成后可在线预览也可以直接下载视频文件。⚙️ 调优部署方案与参数选择方案启动命令说明标准版docker-compose up -d3 个服务含 ASR 和 TTS功能完整精简版 litedocker-compose -f docker-compose-lite.yml up -d只有视频合成 1 个服务资源占用低50 系显卡版docker-compose -f docker-compose-5090.yml up -d面向 5090 等 50 系显卡基于 CUDA 12.8 的 30/40 系显卡也可用Ubuntu 系统docker-compose -f docker-compose-linux.yml up -d需先装 NVIDIA Container Toolkit 并配置 docker runtime其他参数建议视频合成接口服务启动后在http://127.0.0.1暴露端口视频合成走8383端口ASR/TTS 走18180端口可自行脚本化批量生成音频素材上传纯人声录音背景音和噪音会直接影响合成效果更新服务到deploy/目录重新执行docker-compose up -d即可拉取新版本️ 排坑四个常见报错的解决方法docker-compose up -d拉镜像超时request canceledDocker Hub 官方源不稳定在 Docker 的daemon.json里添加registry-mirrors国内镜像源即可新增模特时报错视频必须带人声且是人在说话无声视频无法做声音克隆定制模特报Connection refusedASR 服务启动慢服务端启动后等几分钟再操作内存 16GB 可能起不来需要 32GB三个容器不是全部 Running先跑nvidia-smi确认显卡驱动正常本项目算力全部在本地没有 NVIDIA 显卡或服务起不来服务端日志直接在 Docker Desktop 里点开对应容器点「复制」客户端日志在右上角「Setting → Open Log」。更多报错对照 常见问题部署文件在 deploy/开放 API 的调用实现参考 src/main/service/。下一步建议按 Ubuntu 或 Windows 流程把服务端跑起来用一段 10 秒的正面口播视频先克隆出第一个模特再生成一条 30 秒的测试口播视频确认口型和声音都正常后再批量产出内容。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表