on-demand-budgeting

Tag

Cards List
#on-demand-budgeting

GrowPage: On-Demand KV Budgeting for Efficient LLM Reasoning Serving

arXiv cs.AI · 2026-09-04 Cached

GrowPage is an on-demand KV budgeting framework that dynamically manages cache capacity to enhance the efficiency of LLM reasoning serving, achieving a superior performance-throughput trade-off over existing methods.

0 favorites 0 likes
← Back to home

Submit Feedback