Усі теги
Тег каталогу

#gguf

Усі репозиторії публічного реєстру з цим тегом — із тем GitHub або ключових слів, які публікують їхні реєстри пакетів. Здоров'я вимірюється за тією ж версіонованою методологією, що й решта реєстру.

14 записів
З тегом «gguf»Упорядковано за індексом здоров'я
PyPI
87Відміннийіндекс здоров'я
ggml-org/llama.cpp
LLM inference in C/C++
C++ · C★ 121.1K↓ 6.6M/міс21 лип. 2026 р.
MIT21 лип. 2026 р. · метрики 1.13.0
PyPI
85Відміннийіндекс здоров'я
intel/auto-round
A SOTA quantization algorithm for high-accuracy low-bit LLM inference, seamlessly optimized for CPU/XPU/CUDA, with multi-datatype support and full compatibility with vLLM, SGLang, and Transformers.
Python · C++★ 1 52016 лип. 2026 р.
Apache-2.016 лип. 2026 р. · метрики 1.13.0
Go
74Добрийіндекс здоров'я
defilantech/llmkube
Kubernetes operator for self-hosted LLM inference across a heterogeneous GPU fleet: NVIDIA CUDA, AMD Vulkan, and Apple Silicon Metal. Runtimes: llama.cpp, vLLM, TGI, mlx-server. Multi-GPU sharding, model caching, OpenAI-compatible endpoints. Apache-2.0, run across homelab and on-prem fleets, actively developed.
Go★ 167↓ 0/міс14 лип. 2026 р.
Apache-2.014 лип. 2026 р. · метрики 1.13.0
PyPI
72Добрийіндекс здоров'я
MakazhanAlpamys/Soup
Soup turns the pain of LLM fine-tuning into a simple workflow. One config, one command, done.
Python★ 7415 лип. 2026 р.
Apache-2.015 лип. 2026 р. · метрики 1.13.0
PyPI · crates.io · npm
71Добрийіндекс здоров'я
alexsjones/llmfit
Hundreds of models & providers. One command to find what runs on your hardware.
Rust★ 29.6K↓ 15.8K/міс17 лип. 2026 р.
MIT17 лип. 2026 р. · метрики 1.13.0
Go
65Помірнийіндекс здоров'я
hybridgroup/yzma
Go with your own intelligence - Go applications that directly integrate llama.cpp for local inference using hardware acceleration.
Go★ 52017 лип. 2026 р.
Власна ліцензія17 лип. 2026 р. · метрики 1.13.0
Go
62Помірнийіндекс здоров'я
gpustack/gguf-parser-go
Review/Check GGUF files and estimate the memory usage and maximum tokens per second.
Go★ 276↓ 0/міс14 лип. 2026 р.
MIT14 лип. 2026 р. · метрики 1.13.0
PyPI · crates.io
61Помірнийіндекс здоров'я
handy-computer/transcribe.cpp
ggml speech-to-text inference for 16+ model families
C++ · C★ 197↓ 7 559/міс17 лип. 2026 р.
MIT17 лип. 2026 р. · метрики 1.13.0
Go
60Помірнийіндекс здоров'я
aimd54/palan
Pull, push, pack, and serve GGUF models as OCI ModelPack artifacts — daemonless, air-gap-first, one binary
Go★ 017 лип. 2026 р.
Apache-2.017 лип. 2026 р. · метрики 1.13.0
Go · PyPI
59Помірнийіндекс здоров'я
anthony-chaudhary/fak
fak — the Fused Agent Kernel: one Go binary for AI agent loops. Wrap Claude Code/Codex/Cursor, keep long sessions cache-efficient, route work per call, run local GGUF models, and adjudicate tool calls.
Go · Python★ 1517 лип. 2026 р.
Apache-2.017 лип. 2026 р. · метрики 1.13.0
npm
59Помірнийіндекс здоров'я
therealtimex/node-llama-cpp
Run AI models locally on your machine with node.js bindings for llama.cpp. Enforce a JSON schema on the model output on the generation level
TypeScript★ 1↓ 41.2K/міс17 лип. 2026 р.
MIT17 лип. 2026 р. · метрики 1.13.0
Go
57Помірнийіндекс здоров'я
thxcode/gguf-parser-go
Review/Check GGUF files and estimate the memory usage and maximum tokens per second.
Go★ 27615 лип. 2026 р.
MIT15 лип. 2026 р. · метрики 1.13.0
npm
55Помірнийіндекс здоров'я
mohitsoni48/TurboLLM
Run any local LLM engine, auto-tuned to your GPU — polished web UI + OpenAI/Anthropic-compatible API. Point Claude Code at your own machine in one command. No Electron, no Python, offline-first.
TypeScript★ 173↓ 6 179/міс16 лип. 2026 р.
Без ліцензії16 лип. 2026 р. · метрики 1.13.0
PyPI
54Помірнийіндекс здоров'я
jjang-ai/jangq
JANG — GGUF for MLX. YOU MUST USE JANG_Q RUNTIME. Adaptive Mixed-Precision Quantization + Runtime for Apple Silicon
Python · Swift★ 21422 лип. 2026 р.
Без ліцензії22 лип. 2026 р. · метрики 1.13.0