Усі теги
Тег каталогу

#llm-evaluation-framework

Усі репозиторії публічного реєстру з цим тегом — із тем GitHub або ключових слів, які публікують їхні реєстри пакетів. Здоров'я вимірюється за тією ж версіонованою методологією, що й решта реєстру.

3 записи
З тегом «llm-evaluation-framework»Упорядковано за індексом здоров'я
npm
80Добрийіндекс здоров'я
promptfoo/promptfoo
Test your prompts, agents, and RAGs. Red teaming/pentesting/vulnerability scanning for AI. Compare performance of GPT, Claude, Gemini, DeepSeek, and more. Simple declarative configs with command line and CI/CD integration. Used by OpenAI and Anthropic.
TypeScript★ 23.4K↓ 1.7M/міс17 лип. 2026 р.
MIT17 лип. 2026 р. · метрики 1.13.0
npm · PyPI
78Добрийіндекс здоров'я
confident-ai/deepeval
The LLM Evaluation Framework
Python · TypeScript★ 17K↓ 17.7K/міс20 лип. 2026 р.
Apache-2.020 лип. 2026 р. · метрики 1.13.0
RubyGems
61Помірнийіндекс здоров'я
homemade-software-inc/completion-kit
Your prompts need tests too. Run prompts against real datasets, score outputs with LLM judges, version everything, and compare runs to see what got better.
Ruby · HTML★ 117 лип. 2026 р.
Власна ліцензія17 лип. 2026 р. · метрики 1.13.0