Alle Tags
Katalog-Tag

#rl

Alle Repositories im öffentlichen Register, die dieses Tag tragen — aus ihren GitHub-Topics oder den von ihren Paket-Registries veröffentlichten Schlagwörtern. Die Gesundheit wird nach derselben versionierten Methodik gemessen wie im übrigen Register.

10 Einträge
Getaggt als „rl“Geordnet nach Gesundheitsindex
PyPI
96AußergewöhnlichGesundheitsindex
Farama-Foundation/Gymnasium
A standard API for single-agent reinforcement learning environments, with popular reference environments and related utilities (formerly Gym)
Python★ 12.4K↓ 5.7M/Monat27. Aug. 2026
MIT27. Aug. 2026 · Metriken 2.10.0
PyPI
94AußergewöhnlichGesundheitsindex
PrimeIntellect-ai/verifiers
Our library for RL environments + evals
Python★ 4.565↓ 378.1K/Monat28. Aug. 2026
MIT28. Aug. 2026 · Metriken 2.10.0
PyPI · npm · crates.io
94AußergewöhnlichGesundheitsindex
tensorlakeai/tensorlake
Tensorlake is a serverless runtime for sandboxes and deploying background agentic applications
Python · Rust · TypeScript★ 976↓ 153K/Monat31. Juli 2026
Apache-2.031. Juli 2026 · Metriken 2.10.0
PyPI · npm
93AußergewöhnlichGesundheitsindex
NVIDIA-NeMo/Gym
Evaluate and improve models and agents using environments
Python · MDX★ 1.055↓ 406.4K/Monat18. Juli 2026
Apache-2.018. Juli 2026 · Metriken 2.10.0
PyPI
92ExzellentGesundheitsindex
JudgmentLabs/judgeval
The Continuous-Improvement Stack for Agents. Our environment data and evals power agent improvement and monitoring.
Python★ 1.057↓ 233.1K/Monat13. Aug. 2026
Apache-2.013. Aug. 2026 · Metriken 2.10.0
PyPI
91ExzellentGesundheitsindex
pytorch/rl
A modular, primitive-first, python-first PyTorch library for Reinforcement Learning.
Python★ 3.548↓ 84.8K/Monat5. Sept. 2026
MIT5. Sept. 2026 · Metriken 2.10.0
PyPI
90ExzellentGesundheitsindex
Farama-Foundation/PettingZoo
A standard API for multi-agent reinforcement learning environments, with popular reference environments and related utilities
Python★ 3.48913. Aug. 2026
MIT13. Aug. 2026 · Metriken 2.10.0
PyPI
75GutGesundheitsindex
freesolo-co/flash
LoRA post-training for open-weight models: SFT, GRPO, and on-policy distillation. Describe a run in TOML; Flash allocates a GPU, trains, streams checkpoints, and serves the adapter.
Python★ 2↓ 5.834/Monat29. Aug. 2026
Apache-2.029. Aug. 2026 · Metriken 2.10.0
crates.io
60MittelGesundheitsindex
rust-control/rusty_mujoco
A safe, low-level Rust binding for MuJoCo physics simulator
Rust★ 9↓ 2.162/Monat17. Juli 2026
Apache-2.017. Juli 2026 · Metriken 2.10.0
npm
50MittelGesundheitsindex
ruvnet/agentdb
Vector memory that gets smarter every time your agent uses it.
TypeScript · HTML · JavaScript★ 80↓ 649.1K/Monat23. Juli 2026
MIT23. Juli 2026 · Metriken 2.10.0