Усі теги
Тег каталогу

#model-comparison

Усі репозиторії публічного реєстру з цим тегом — із тем GitHub або ключових слів, які публікують їхні реєстри пакетів. Здоров'я вимірюється за тією ж версіонованою методологією, що й решта реєстру.

3 записи
З тегом «model-comparison»Упорядковано за індексом здоров'я
78Добрийіндекс здоров'я
stan-dev/loo
loo R package for approximate leave-one-out cross-validation (LOO-CV) and Pareto smoothed importance sampling (PSIS)
R★ 15730 серп. 2026 р.
Власна ліцензія30 серп. 2026 р. · метрики 2.10.0
RubyGems
59Помірнийіндекс здоров'я
justi/ruby_llm-contract
Validate and retry LLM outputs for ruby_llm. Describe the JSON response you expect, fall back to a stronger model when the cheaper one fails the rules, and gate CI on regressions — all as one contract object per step.
Ruby★ 3522 серп. 2026 р.
MIT22 серп. 2026 р. · метрики 2.10.0
Go
41Слабкийіндекс здоров'я
CircleCI-Research/evalbench
Evaluate LLMs side-by-side. Benchmark AI models and coding agents across providers like OpenAI, Google, Anthropic, DeepSeek, and more. Supports custom tasks, structured JSON responses, tool use, and LLM-as-judge validation. Originally created by Petr Malik as MindTrial.
HTML★ 025 лип. 2026 р.
MPL-2.025 лип. 2026 р. · метрики 2.10.0