Tao Liu

Expert
@liutaocode

Vibe Coding Everyday~

TTS-arxiv-daily. Automatically Update Text-to-speech (TTS) Papers Daily using Github Actions (Update Every 12th hours)

663

talking-face-arxiv-daily. 🎓 Update Talking-Face Research Papers Daily

458

talking_face_preprocessing. Preprocessing Scipts for Talking Face Generation

97

DiffDub. [ICASSP 2024] DiffDub: Person-generic visual dubbing using inpainting renderer with diffusion auto-encoder

70

LivePortrait-Train. Unoffical LivePortrait Training Script [ 🚧 Under Construction]

40

AwesomeDiarizationDataset. Both audio-only and audio-visual speaker diarization datasets are listed here.

16

Vibe_XASR. Swift

14

DiarizationVisualization. Visualization tools for audio-only and multi-modal speaker diarization dataset

13

Video-Generation-arxiv-daily. Automatically Update Video Generation Papers Daily using Github Actions (Update Every 12th hours)

11

DiarizationMetricInOne. Diarization Metric in One: current support DER, JER, CDER, SER, and BER

9

SD-arxiv-daily. Automatically Speaker Diarization (SD) Papers Daily using Github Actions (Update Every 12th hours)

4

AwesomeTokenizer. MultiModal Tokenizer Resources

2

EEND_PyTorch. A PyTorch implementation of End-to-End Neural Diarization

2

Multi-modal-Speech-Dataset. Multi-modal Speech Dataset

2

talking_face_evaluation_metrics.

2

talking_face_datasets.

2

EDTalk_facesr. [ECCV 2024] EDTalk - PyTorch Implementation with Face SR (512*512)

2

dscore-ovl. Detailed information for diarization metric: dscore, including errors in overlapped part.

1

BER. Balanced Error Rate for Speaker Diarization

1

diffusers. 🤗 Diffusers: State-of-the-art diffusion models for image and audio generation in PyTorch

1

EMOPortraits. Add Video Reenactment Pipeline to EMOPortraits

1

WorkflowVisualizer. A Workflow Visualizer For Claude Code

1
22
Apply