Усі теги
Тег каталогу

#kv-cache

Усі репозиторії публічного реєстру з цим тегом — із тем GitHub або ключових слів, які публікують їхні реєстри пакетів. Здоров'я вимірюється за тією ж версіонованою методологією, що й решта реєстру.

11 записів
З тегом «kv-cache»Упорядковано за індексом здоров'я
PyPI · Go
98Винятковийіндекс здоров'я
LMCache/LMCache
LMCache: Supercharge Your LLM with the Fastest KV Cache Layer
Python★ 11.2K↓ 98.8K/міс15 серп. 2026 р.
Apache-2.015 серп. 2026 р. · метрики 2.10.0
PyPI
98Винятковийіндекс здоров'я
kvcache-ai/Mooncake
Mooncake is the serving platform for Kimi, a leading LLM service provided by Moonshot AI.
C++ · Python★ 6 25612 серп. 2026 р.
Apache-2.012 серп. 2026 р. · метрики 2.10.0
PyPI
95Винятковийіндекс здоров'я
MemTensor/MemOS
Self-evolving memory OS for LLM & AI Agents: ultra-persistent memory, hybrid-retrieval, and cross-task skill reuse, with 35.24% token savings and DeepSeek Harness support.
TypeScript · Python★ 11K28 серп. 2026 р.
Apache-2.028 серп. 2026 р. · метрики 2.10.0
PyPI · npm
84Відміннийіндекс здоров'я
rajveer43/VeloxQuant-MLX
Fast KV-cache quantization for Apple Silicon (MLX) — 43 research-adapted compression methods with Metal kernels
Python★ 15↓ 7 549/міс5 вер. 2026 р.
MIT5 вер. 2026 р. · метрики 2.10.0
PyPI
80Відміннийіндекс здоров'я
manjunathshiva/turboquant-mlx
Extreme weight + KV cache compression for LLMs on Apple Silicon (MLX implementation of Google's TurboQuant)
Python★ 83↓ 1 116/міс28 серп. 2026 р.
Власна ліцензія28 серп. 2026 р. · метрики 2.10.0
PyPI · crates.io
77Добрийіндекс здоров'я
ahb-sjsu/turboquant-pro
Consumer-aware compression for embedding indexes and LLM KV caches — compress by the metric the downstream consumer actually uses. PCA-Matryoshka + TurboQuant (27x @ 99.8% recall@10), asymmetric K/V, CUDA/Triton kernels, vLLM plugin, replayable CI-gated claims. MIT.
Python★ 25↓ 277/міс5 вер. 2026 р.
MIT5 вер. 2026 р. · метрики 2.10.0
PyPI
71Добрийіндекс здоров'я
varjoranta/turboquant-vllm
TurboQuant+ KV cache compression for vLLM. 3.8x smaller KV cache, same conversation quality. Fused CUDA kernels with automatic PyTorch fallback.
Python · C++ · Cuda★ 76↓ 960/міс22 лип. 2026 р.
MIT22 лип. 2026 р. · метрики 2.10.0
Go · PyPI
65Добрийіндекс здоров'я
anthony-chaudhary/fak
fak — the Fused Agent Kernel: one Go binary for AI agent loops. Wrap Claude Code/Codex/Cursor, keep long sessions cache-efficient, route work per call, run local GGUF models, and adjudicate tool calls.
Go · Python★ 1517 лип. 2026 р.
Apache-2.017 лип. 2026 р. · метрики 2.10.0
PyPI
63Помірнийіндекс здоров'я
jagmarques/nexusquant
Training-free KV cache compression via E8 lattice VQ. 2-bit KV that preserves retrieval (30/30 NIAH vs TurboQuant 0/30). Calibration-free, 9 architectures validated.
Python★ 2516 лип. 2026 р.
Власна ліцензія16 лип. 2026 р. · метрики 2.10.0
npm
51Помірнийіндекс здоров'я
jiangge/pi-cache-optimizer
Improve Pi prompt/KV cache hit rates with stable prompts, OpenAI-compatible cache keys, proxy compat warnings, and footer cache stats.
TypeScript · Python★ 40↓ 4 809/міс24 лип. 2026 р.
MIT24 лип. 2026 р. · метрики 2.10.0
crates.io
44Слабкийіндекс здоров'я
RecursiveIntell/turbo-quant
Rust implementation of TurboQuant, PolarQuant, and QJL — zero-overhead vector quantization for semantic search and KV cache compression (ICLR 2026)
Rust · Python★ 26↓ 3 048/міс22 серп. 2026 р.
MIT22 серп. 2026 р. · метрики 2.10.0