GitHub - lipku/LiveTalking: Real time interactive streaming digital human

Real time interactive streaming digital human， realize audio video synchronous dialogue. It can basically achieve commercial effects.
实时交互流式数字人，实现音视频同步对话。基本可以达到商用效果

ernerf效果 musetalk效果 wav2lip效果

为避免与3d数字人混淆，原项目metahuman-stream改名为livetalking，原有链接地址继续可用

News

2024.12.8 完善多并发，显存不随并发数增加
2024.12.21 添加wav2lip、musetalk模型预热，解决第一次推理卡顿问题。感谢@heimaojinzhangyz
2024.12.28 添加数字人模型Ultralight-Digital-Human。感谢@lijihua2017

Features

支持多种数字人模型: ernerf、musetalk、wav2lip、Ultralight-Digital-Human
支持声音克隆
支持数字人说话被打断
支持全身视频拼接
支持rtmp和webrtc
支持视频编排：不说话时播放自定义视频
支持多并发

1. Installation

Tested on Ubuntu 20.04, Python3.10, Pytorch 1.12 and CUDA 11.3

1.1 Install dependency

conda create -n nerfstream python=3.10
conda activate nerfstream
#如果cuda版本不为11.3(运行nvidia-smi确认版本)，根据<https://pytorch.org/get-started/previous-versions/>安装对应版本的pytorch 
conda install pytorch==1.12.1 torchvision==0.13.1 cudatoolkit=11.3 -c pytorch
pip install -r requirements.txt
#如果不训练ernerf模型，不需要安装下面的库
pip install "git+https://github.com/facebookresearch/pytorch3d.git"
pip install tensorflow-gpu==2.8.0
pip install --upgrade "protobuf<=3.20.1"

安装常见问题FAQ
linux cuda环境搭建可以参考这篇文章 https://zhuanlan.zhihu.com/p/674972886

2. Quick Start

默认采用ernerf模型，webrtc推流到srs

2.1 运行srs

export CANDIDATE='<服务器外网ip>'  #如果srs与浏览器访问在同一层级内网，不需要执行这步
docker run --rm --env CANDIDATE=$CANDIDATE \
  -p 1935:1935 -p 8080:8080 -p 1985:1985 -p 8000:8000/udp \
  registry.cn-hangzhou.aliyuncs.com/ossrs/srs:5 \
  objs/srs -c conf/rtc.conf

备注：服务端需要开放端口 tcp:8000,8010,1985; udp:8000

2.2 启动数字人：

python app.py

如果访问不了huggingface，在运行前

export HF_ENDPOINT=https://hf-mirror.com

用浏览器打开http://serverip:8010/rtcpushapi.html, 在文本框输入任意文字，提交。数字人播报该段文字

3. More Usage

使用说明: https://livetalking-doc.readthedocs.io/

4. Docker Run

不需要前面的安装，直接运行。

docker run --gpus all -it --network=host --rm registry.cn-beijing.aliyuncs.com/codewithgpu2/lipku-metahuman-stream:vjo1Y6NJ3N

代码在/root/metahuman-stream，先git pull拉一下最新代码，然后执行命令同第2、3步

提供如下镜像

autodl镜像: https://www.codewithgpu.com/i/lipku/metahuman-stream/base
autodl教程
ucloud镜像: https://www.compshare.cn/images-detail?ImageID=compshareImage-16ktl2kxwjef&ImageType=Community&referral_code=3XW3852OBmnD089hMMrtuU&ytag=lipku_github
可以开放任意端口，不需要另外部署srs服务.
ucloud教程

5. TODO

如果本项目对你有帮助，帮忙点个star。也欢迎感兴趣的朋友一起来完善该项目.

知识星球: https://t.zsxq.com/7NMyO 沉淀高质量常见问题、最佳实践经验、问题解答
微信公众号：数字人技术

Name		Name	Last commit message	Last commit date
Latest commit History 164 Commits
assets		assets
data		data
ernerf		ernerf
llm		llm
models		models
musetalk		musetalk
ultralight		ultralight
wav2lip		wav2lip
web		web
.gitignore		.gitignore
Dockerfile		Dockerfile
LICENSE		LICENSE
README.md		README.md
app.py		app.py
baseasr.py		baseasr.py
basereal.py		basereal.py
lightasr.py		lightasr.py
lightreal.py		lightreal.py
lipasr.py		lipasr.py
lipreal.py		lipreal.py
museasr.py		museasr.py
musereal.py		musereal.py
nerfasr.py		nerfasr.py
nerfreal.py		nerfreal.py
requirements.txt		requirements.txt
ttsreal.py		ttsreal.py
webrtc.py		webrtc.py

Provide feedback

Saved searches

Use saved searches to filter your results more quickly

Repository files navigation

为避免与3d数字人混淆，原项目metahuman-stream改名为livetalking，原有链接地址继续可用

News

Features

1. Installation

1.1 Install dependency

2. Quick Start

2.1 运行srs

2.2 启动数字人：

3. More Usage

4. Docker Run

5. TODO

About

Releases

Contributors 12

Languages

License

lipku/LiveTalking

Folders and files

Latest commit

History

Repository files navigation

为避免与3d数字人混淆，原项目metahuman-stream改名为livetalking，原有链接地址继续可用

News

Features

1. Installation

1.1 Install dependency

2. Quick Start

2.1 运行srs

2.2 启动数字人：

3. More Usage

4. Docker Run

5. TODO

About

Topics

Resources

License

Stars

Watchers

Forks

Releases

Contributors 12

Languages