Back to feed
Reddit r/LocalLLaMA·

proveKV – Honest 36× lossless (vs f32, 18x vs fp16) KV‑cache compression for LLMs (zero PPL regression)

Signal
78
Hype
25
In three linesproveKV: open-source KV-cache compression technique for LLMs. Results: 36× lossless memory reduction vs f32, 18× vs fp16 on SmolLM2-1.7B + WikiText-2 (0% PPL regression). Automated audit pipeline with reproducible validation.
Read source
Your take?
Open sourceInfrastructureBenchmarks

Summary generated by Claude — human-verified