<!-- llms-explorer concept facts · https://llms-explorer.com/tree/turboquant-kv-cache-compression-hadamard-lloyd-m/ · pack 2026-10-05 · ~253 tokens -->

# TurboQuant KV cache compression (Hadamard, Lloyd-Max, QJL)

> The concept is already covered by turboquant-and-rotation-based-kv-quantization-on-metal.md, llama-cpp-attention-rotation-hadamard-for-quanti.md and qjl-residual-correction-needed-or-harmful.md; sources checked in this batch (arXiv 2504.19874, llama.cpp discussion 20969, the Hannecke five-integra...

Parent: [Mac local LLMs: KV cache sizing and quantization](https://llms-explorer.com/tree/mac-local-llms-kv-cache-sizing-and-quantization/) · 1 facets · 1 facts · page: https://llms-explorer.com/tree/turboquant-kv-cache-compression-hadamard-lloyd-m/

## Facts

- The concept is already covered by turboquant-and-rotation-based-kv-quantization-on-metal.md, llama-cpp-attention-rotation-hadamard-for-quanti.md and qjl-residual-correction-needed-or-harmful.md; sources checked in this batch (arXiv 2504.19874, llama.cpp discussion 20969, the Hannecke five-integration-paths article) are already cited there and add nothing new. — source: `asserted`
