Hugging Face daily papers·23d agoBeaconKV: Key-Value Cache Compression Guided by Beacon Queries for Efficient Large Reasoning Model Inference#chain-of-thought#inference-optimization#kv-cache1