Vibe Coding Everyday~
TTS-arxiv-daily. Automatically Update Text-to-speech (TTS) Papers Daily using Github Actions (Update Every 12th hours)
663talking-face-arxiv-daily. 🎓 Update Talking-Face Research Papers Daily
458talking_face_preprocessing. Preprocessing Scipts for Talking Face Generation
97DiffDub. [ICASSP 2024] DiffDub: Person-generic visual dubbing using inpainting renderer with diffusion auto-encoder
70LivePortrait-Train. Unoffical LivePortrait Training Script [ 🚧 Under Construction]
40AwesomeDiarizationDataset. Both audio-only and audio-visual speaker diarization datasets are listed here.
16Vibe_XASR. Swift
14DiarizationVisualization. Visualization tools for audio-only and multi-modal speaker diarization dataset
13Video-Generation-arxiv-daily. Automatically Update Video Generation Papers Daily using Github Actions (Update Every 12th hours)
11DiarizationMetricInOne. Diarization Metric in One: current support DER, JER, CDER, SER, and BER
9SD-arxiv-daily. Automatically Speaker Diarization (SD) Papers Daily using Github Actions (Update Every 12th hours)
4AwesomeTokenizer. MultiModal Tokenizer Resources
2EEND_PyTorch. A PyTorch implementation of End-to-End Neural Diarization
2Multi-modal-Speech-Dataset. Multi-modal Speech Dataset
2talking_face_evaluation_metrics.
2talking_face_datasets.
2EDTalk_facesr. [ECCV 2024] EDTalk - PyTorch Implementation with Face SR (512*512)
2dscore-ovl. Detailed information for diarization metric: dscore, including errors in overlapped part.
1BER. Balanced Error Rate for Speaker Diarization
1diffusers. 🤗 Diffusers: State-of-the-art diffusion models for image and audio generation in PyTorch
1EMOPortraits. Add Video Reenactment Pipeline to EMOPortraits
1WorkflowVisualizer. A Workflow Visualizer For Claude Code
1