Todas las etiquetas
Etiqueta del catálogo

#multi-gpu

Todos los repositorios del registro público que llevan esta etiqueta, procedente de sus topics de GitHub o de las palabras clave que publican sus registros de paquetes. La salud se mide con la misma metodología versionada que el resto del registro.

1 registro
Con la etiqueta «multi-gpu»Ordenado por índice de salud
Go
74Buenoíndice de salud
defilantech/llmkube
Kubernetes operator for self-hosted LLM inference across a heterogeneous GPU fleet: NVIDIA CUDA, AMD Vulkan, and Apple Silicon Metal. Runtimes: llama.cpp, vLLM, TGI, mlx-server. Multi-GPU sharding, model caching, OpenAI-compatible endpoints. Apache-2.0, run across homelab and on-prem fleets, actively developed.
Go★ 167↓ 0/mes14 jul 2026
Apache-2.014 jul 2026 · métricas 1.13.0