This is your work, valued
NLP Researcher @ Tencent | Efficient LLM Reasoning | Long-Context Evaluation
Awesome-LLM-On-Policy-Distillation. A curated collection of papers and resources on On-Policy Distillation for Large Language Models.
479Counting-Stars. Counting-Stars (★)
83FastCuRL. FastCuRL: Curriculum Reinforcement Learning with Stage-wise Context Scaling for Efficient LLM Reasoning (EMNLP 2025)
61Jamba_Paper_Reading. Paper reading: Jamba — Hybrid Transformer-Mamba LM (SSM → S4 → S6 → Jamba)
15ConciseR. Walk Before You Run! Concise LLM Reasoning via Reinforcement Learning
6evol-ruozhiba.
2nick7nlp. Profile README
2Hunyuan-MT. Hunyuan Machine Translation — 🥇 1st in 30/31 WMT25 language pairs
1