Усі теги
Тег каталогу

#kv-cache

Усі репозиторії публічного реєстру з цим тегом — із тем GitHub або ключових слів, які публікують їхні реєстри пакетів. Здоров'я вимірюється за тією ж версіонованою методологією, що й решта реєстру.

5 записів
З тегом «kv-cache»Упорядковано за індексом здоров'я
PyPI
63Помірнийіндекс здоров'я
varjoranta/turboquant-vllm
TurboQuant+ KV cache compression for vLLM. 3.8x smaller KV cache, same conversation quality. Fused CUDA kernels with automatic PyTorch fallback.
Python · C++ · Cuda★ 76↓ 960/міс22 лип. 2026 р.
MIT22 лип. 2026 р. · метрики 1.13.0
PyPI
60Помірнийіндекс здоров'я
jagmarques/nexusquant
Training-free KV cache compression via E8 lattice VQ. 2-bit KV that preserves retrieval (30/30 NIAH vs TurboQuant 0/30). Calibration-free, 9 architectures validated.
Python★ 2516 лип. 2026 р.
Власна ліцензія16 лип. 2026 р. · метрики 1.13.0
Go · PyPI
59Помірнийіндекс здоров'я
anthony-chaudhary/fak
fak — the Fused Agent Kernel: one Go binary for AI agent loops. Wrap Claude Code/Codex/Cursor, keep long sessions cache-efficient, route work per call, run local GGUF models, and adjudicate tool calls.
Go · Python★ 1517 лип. 2026 р.
Apache-2.017 лип. 2026 р. · метрики 1.13.0
npm · PyPI
56Помірнийіндекс здоров'я
rajveer43/VeloxQuant-MLX
TurboQuant MLX implementation for Apple Silicon Faster KV cache quantization optimized for MLX
Python★ 10↓ 4 108/міс14 лип. 2026 р.
MIT14 лип. 2026 р. · метрики 1.13.0
crates.io
39У зоні ризикуіндекс здоров'я
RecursiveIntell/turbo-quant
Rust implementation of TurboQuant, PolarQuant, and QJL — zero-overhead vector quantization for semantic search and KV cache compression (ICLR 2026)
Rust★ 29↓ 2 256/міс13 лип. 2026 р.
MIT13 лип. 2026 р. · метрики 1.13.0