Усі теги
Тег каталогу

#llm-benchmarking

Усі репозиторії публічного реєстру з цим тегом — із тем GitHub або ключових слів, які публікують їхні реєстри пакетів. Здоров'я вимірюється за тією ж версіонованою методологією, що й решта реєстру.

1 запис
З тегом «llm-benchmarking»Упорядковано за індексом здоров'я
Go
57Помірнийіндекс здоров'я
petmal/MindTrial
MindTrial: Evaluate and compare AI language models (LLMs) on text-based tasks with optional file/image attachments and tool use. Supports multiple providers (OpenAI, Google, Anthropic, DeepSeek, Mistral AI, xAI, Alibaba, Moonshot AI, OpenRouter), custom tasks in YAML, and HTML/CSV/JSON reports.
Go★ 1730 серп. 2026 р.
MPL-2.030 серп. 2026 р. · метрики 2.10.0