Aleph-Alpha-Research
eval-framework
Comprehensive LLM evaluation at scale: A production-ready framework for evaluating large language models across multiple benchmarks.
41 Sterne6 ForksPythonApache-2.0
Datenaktualität
Klassifizierung
Comprehensive LLM evaluation at scale: A production-ready framework for evaluating large language models across multiple benchmarks.
Der Projektkontext auf dieser Seite ist kostenlos lesbar. Das ursprüngliche GitHub-Repository bleibt maßgeblich; nur zum Speichern oder Diskutieren ist eine Anmeldung nötig.
Community-Notizen