Todas las etiquetas
Etiqueta del catálogo

#llm-inference

Todos los repositorios del registro público que llevan esta etiqueta, procedente de sus topics de GitHub o de las palabras clave que publican sus registros de paquetes. La salud se mide con la misma metodología versionada que el resto del registro.

35 registros
Con la etiqueta «llm-inference»Ordenado por índice de salud
PyPI
57Moderadoíndice de salud
google/jetstream
JetStream is a throughput and memory optimized engine for LLM inference on XLA devices, starting with TPUs (and GPUs in future -- PRs welcome).
Python★ 45118 jul 2026
Apache-2.018 jul 2026 · métricas 2.10.0
PyPI
53Moderadoíndice de salud
ARahim3/mlx-dspark
Up to 4× faster LLM decoding on Apple Silicon, lossless. Native MLX port of DeepSeek's DSpark & z-lab's DFlash speculative decoding — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, ternary Bonsai-27B.
Python · Swift★ 430↓ 5564/mes19 ago 2026
MIT19 ago 2026 · métricas 2.10.0
npm
50Moderadoíndice de salud
empirical-run/empirical
Test and evaluate LLMs and model configurations, across all the scenarios that matter for your application
TypeScript★ 16715 jul 2026
MIT15 jul 2026 · métricas 2.10.0
47Débilíndice de salud
MekayelAnik/vllm-cpu
Wheels & Docker images for running vLLM on CPU-only systems, optimized for different CPU instruction sets
Shell★ 810 ago 2026
GPL-3.010 ago 2026 · métricas 2.10.0
PyPI
34En riesgoíndice de salud
openvinotoolkit/openvino
OpenVINO™ is an open source toolkit for optimizing and deploying AI inference
C++★ 10.6K12 ago 2026
Apache-2.012 ago 2026 · métricas 2.10.0