Усі теги
Тег каталогу

#evaluation-metrics

Усі репозиторії публічного реєстру з цим тегом — із тем GitHub або ключових слів, які публікують їхні реєстри пакетів. Здоров'я вимірюється за тією ж версіонованою методологією, що й решта реєстру.

3 записи
З тегом «evaluation-metrics»Упорядковано за індексом здоров'я
npm · PyPI
78Добрийіндекс здоров'я
confident-ai/deepeval
The LLM Evaluation Framework
Python · TypeScript★ 17K↓ 17.7K/міс20 лип. 2026 р.
Apache-2.020 лип. 2026 р. · метрики 1.13.0
PyPI · npm
71Добрийіндекс здоров'я
AgentOps-AI/agentops
Python SDK for AI agent monitoring, LLM cost tracking, benchmarking, and more. Integrates with most LLMs and agent frameworks including CrewAI, Agno, OpenAI Agents SDK, Langchain, Autogen, AG2, and CamelAI
Python · TypeScript★ 5 71621 лип. 2026 р.
MIT21 лип. 2026 р. · метрики 1.13.0
RubyGems
61Помірнийіндекс здоров'я
homemade-software-inc/completion-kit
Your prompts need tests too. Run prompts against real datasets, score outputs with LLM judges, version everything, and compare runs to see what got better.
Ruby · HTML★ 117 лип. 2026 р.
Власна ліцензія17 лип. 2026 р. · метрики 1.13.0