This is your work, valued
LLM, Agent
Linear-Transformer. Transformer are RNNs: Fast Autoregressive Transformer with Linear Attention
25LPT. This repo contains the code for Late Prompt Tuning.
12awesome-early-exiting. A curated list of Early Exiting papers, benchmarks, and misc.
1RoSE. The code for paper "Making Large Language Models Better Reasoners with Orchestrated Streaming Experiences"
1