用一段10秒视频做出你的AI数字人口播视频:Duix.Avatar 快速上手
发布时间:2026/9/11 15:12:25 作者:尧图编辑部 阅读量:1,286

用一段10秒视频做出你的AI数字人口播视频Duix.Avatar 快速上手【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一个免费开源、完全离线的 AI 数字人项目提交一段 10 秒左右的视频即可克隆你的形象和声音输入文案或上传音频就能生成口播视频。它解决口播视频要出镜、商用服务收费、数据要传上云这几个痛点。本文从硬件要求讲到第一次产出。它到底能帮你干什么这个项目把形象克隆、声音克隆、视频合成三件事打包进了一个桌面客户端常见用法有三种自媒体与短视频博主录一次 10 秒的说话视频就能做出你的数字分身之后输入文案即出视频不用反复出镜拍摄。文案支持中、英、日、韩、法、德、阿拉伯、西语 8 种语言。讲师与企业内训师把一份讲稿变成视频课程声音用你的克隆音形象用你本人省掉录课流程。支持导入多个数字人模型不同课程内容可以切换不同形象。企业宣发与电销团队批量生成宣传口播和产品讲解视频服务端在本地暴露 API开发者可以把数字人生成能力接进自己的业务系统。图Duix.Avatar 客户端主界面我的数字人存放克隆好的形象Create Video / Create Avatar是两个主入口上手之前先确认这几件事Duix.Avatar 最低配置要求系统Windows 10 19042.1526 或更高版本Ubuntu 22.04 Desktop 已验证可用。磁盘Windows 需要 D 盘存放数字人和作品数据空闲 30G 以上C 盘存 Docker 镜像空闲 100G 以上不足时可在 Docker 设置中更换镜像位置。内存32G 及以上硬性要求。显卡英伟达显卡且正确安装驱动硬性要求推荐 RTX 4070。Ubuntu 还需安装 NVIDIA Container Toolkit 让 Docker 调用 GPU。四条都满足就值得试项目完全开源支持全球免费商用用户量超 10 万或年营收超 1000 万美元的企业需签署商业许可协议。没有英伟达显卡则三个服务端都起不来不建议强上。 最快上手路径主线四步Docker 环境 → 部署服务 → 安装客户端 → 做出第一个数字人。第一步准备 Docker 环境Windows用wsl --list --verbose查看 WSL未更新则执行wsl --update再安装 Docker Desktop。C 盘空间不足时到 Settings → Resources → Advanced 把 Disk image location 改到空间充足的磁盘。图Docker Desktop 的 Resources 设置页C 盘不足时可在此修改镜像文件位置第二步部署服务端git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose up -d等待约半小时下载约 70G建议连 WIFI。Docker 中出现三个 Running 状态的服务即部署成功。第三步安装客户端Windows 双击官方构建的 Duix.Avatar-x.x.x-setup.exeUbuntu 双击 AppImage 即可运行root 用户进入桌面时需在命令行加--no-sandbox参数。第四步产出第一个口播视频点Create Avatar上传 10 秒视频必须有声音、是人在说话训练完成后模型出现在我的数字人输入文案或上传音频生成第一条口播视频。语言切换、客户端日志入口在右上角设置菜单里。图右上角设置菜单包含用户协议、打开客户端日志、语言切换⚙️ 进阶玩法与常用配置轻量版部署磁盘或显存吃紧时在 deploy 目录改用下面的命令只保留视频合成服务不部署声音克隆与 ASR对应配置文件 deploy/docker-compose-lite.ymldocker-compose -f docker-compose-lite.yml up -dNVIDIA 50 系显卡5090 用户使用 docker-compose-5090.yml 这份 compose基于 torch 官方预览版30/40 系中 cuda12.8 的用户也可切换到该方案。本地 API 接入服务启动后 18180 端口提供语音预处理与合成8383 端口提供视频合成提交 进度查询请求参数中的 watermark_switch水印和 chaofen超分在此配置调用示例见 src/main/service/ 下的 model.js、voice.js、video.js 三个文件。⚠️ 容易翻车的几个地方up -d报错连不上 registry-1.docker.ioDocker Hub 官方源连接不稳定。在 daemon.json 的 registry-mirrors 中配置国内镜像源重启 Docker 再执行。图在 Docker 的 daemon.json 中添加 registry-mirrors镜像源会随时间失效需自行找最新可用的新增模特报错用于创建模特的视频必须有声音、且是人在说话。程序要用视频里的声音做声音克隆静音视频必然失败重录一段 10 秒说话视频再上传。定制模特报 Connection refusedASR 服务启动较慢。等服务起来后等几分钟再做克隆操作另外内存只有 16G 的机器可能根本启动不了仍需 32G。服务起不来或反复重启本项目所有算力都在本地没有英伟达显卡或没装驱动三个服务都会启动失败。用nvidia-smi确认显卡可见并到 Docker 里查看日志定位报错。图打开 Docker 服务的日志面板点复制即可把服务端日志取出来排查写在最后有英伟达显卡 32G 内存、想本地离线做口播视频的值得花一小时部署这个项目没有显卡或只想直接要结果的可以跳过。学习入口排查指南在 doc/常见问题.md完整部署文档见 README_zh.md。今晚把镜像拉完明天就能看到你的第一条数字人口播视频。使用本人或他人形象、声音生成内容前请取得明确授权不用于欺诈、造谣等违法违规用途。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考