This is your work, valued
polarquant-kv. LLM KV Cache compression - K+V dual compression, 73-99% VRAM savings, zero accuracy loss
FunASR. A Fundamental End-to-End Speech Recognition Toolkit and Open Source SOTA Pretrained Models, Supporting Speech Recognition, Voice Activity Detection, Text Post-processing etc.