# OnlyTerp/turboquant

First open-source implementation of Google TurboQuant (ICLR 2026) -- near-optimal KV cache compression for LLM inference. 5x compression with near-zero quality loss.

**Commercial license**：Commercial OK — 可商用，通常只需保留著作權聲明/授權條款

**Stars**：76
**Source**：https://github.com/OnlyTerp/turboquant
