Alle Tags
Katalog-Tag

#llm-inference

Alle Repositories im öffentlichen Register, die dieses Tag tragen — aus ihren GitHub-Topics oder den von ihren Paket-Registries veröffentlichten Schlagwörtern. Die Gesundheit wird nach derselben versionierten Methodik gemessen wie im übrigen Register.

35 Einträge
Getaggt als „llm-inference“Geordnet nach Gesundheitsindex
PyPI
57MittelGesundheitsindex
google/jetstream
JetStream is a throughput and memory optimized engine for LLM inference on XLA devices, starting with TPUs (and GPUs in future -- PRs welcome).
Python★ 45118. Juli 2026
Apache-2.018. Juli 2026 · Metriken 2.10.0
PyPI
53MittelGesundheitsindex
ARahim3/mlx-dspark
Up to 4× faster LLM decoding on Apple Silicon, lossless. Native MLX port of DeepSeek's DSpark & z-lab's DFlash speculative decoding — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, ternary Bonsai-27B.
Python · Swift★ 430↓ 5.564/Monat19. Aug. 2026
MIT19. Aug. 2026 · Metriken 2.10.0
npm
50MittelGesundheitsindex
empirical-run/empirical
Test and evaluate LLMs and model configurations, across all the scenarios that matter for your application
TypeScript★ 16715. Juli 2026
MIT15. Juli 2026 · Metriken 2.10.0
47SchwachGesundheitsindex
MekayelAnik/vllm-cpu
Wheels & Docker images for running vLLM on CPU-only systems, optimized for different CPU instruction sets
Shell★ 810. Aug. 2026
GPL-3.010. Aug. 2026 · Metriken 2.10.0
PyPI
34GefährdetGesundheitsindex
openvinotoolkit/openvino
OpenVINO™ is an open source toolkit for optimizing and deploying AI inference
C++★ 10.6K12. Aug. 2026
Apache-2.012. Aug. 2026 · Metriken 2.10.0