Alle Tags
Katalog-Tag

#ai-evaluation-tools

Alle Repositories im öffentlichen Register, die dieses Tag tragen — aus ihren GitHub-Topics oder den von ihren Paket-Registries veröffentlichten Schlagwörtern. Die Gesundheit wird nach derselben versionierten Methodik gemessen wie im übrigen Register.

1 Eintrag
Getaggt als „ai-evaluation-tools“Geordnet nach Gesundheitsindex
Go
57MittelGesundheitsindex
petmal/MindTrial
MindTrial: Evaluate and compare AI language models (LLMs) on text-based tasks with optional file/image attachments and tool use. Supports multiple providers (OpenAI, Google, Anthropic, DeepSeek, Mistral AI, xAI, Alibaba, Moonshot AI, OpenRouter), custom tasks in YAML, and HTML/CSV/JSON reports.
Go★ 1730. Aug. 2026
MPL-2.030. Aug. 2026 · Metriken 2.10.0