Home / π§± AI Foundation Stack / β‘ Inference / Serving
unixsysdev/llama-turboquant
TurboQuant 3-bit KV-cache quantization for llama.cpp
Commercial license
β Commercial OKMIT
ε―εη¨οΌιεΈΈεͺιδΏηθδ½ζ¬θ²ζ/ζζ¬ζ’ζ¬Ύ
Topics
kv-cachellama-cppllm-inferencequantizationturboquant
Ad