KVCompose: Efficient Structured KV Cache Compression with Composite Tokens
View Full PaperAuthors
Loading...
Proposed method improves memory efficiency in long-context language models, suggesting better scalability.
Akulov et al. (2025) studied this question.