ECAPA-TDNN. Unofficial reimplementation of ECAPA-TDNN for speaker recognition (EER=0.86 for Vox1_O when train only in Vox2)
823TalkNet-ASD. ACM MM 2021: 'Is Someone Speaking? Exploring Long-term Temporal Features for Audio-visual Active Speaker Detection'
489Loss-Gated-Learning. ICASSP 2022: 'Self-supervised Speaker Recognition with Loss-gated Learning'
92AVCleanse. ICASSP 2023: 'Speaker recognition with two-step multi-modal deep cleansing'
44SEANet. Code for Audio-Visual Target Speaker Extraction with Selective Auditory Attention (TASLP)
32Speaker-Recognition-Demo. A ResNet Speaker Recognition&Verification Demo
27MFV-KSD. Multi-Stage Face-Voice Association Learning with Keynote Speaker Diarization (ACM MM 2024)
22VoxMini. A sublist of VoxCeleb2 with the similar data distribution
5TaoRuijie.
1rayeren.github.io. My personal homepage
1