Aleph-Alpha-Research
eval-framework
Comprehensive LLM evaluation at scale: A production-ready framework for evaluating large language models across multiple benchmarks.
スター 41フォーク 6PythonApache-2.0
情報の鮮度
分類
Comprehensive LLM evaluation at scale: A production-ready framework for evaluating large language models across multiple benchmarks.
このページのプロジェクト情報と編集内容は無料で読めます。元の GitHub リポジトリが最終的な情報源であり、保存や議論への参加時だけログインが必要です。
コミュニティノート