Hysen Labs
モデル / データセット
Aleph-Alpha-Research/eval-framework avatar
Aleph-Alpha-Research

eval-framework

Comprehensive LLM evaluation at scale: A production-ready framework for evaluating large language models across multiple benchmarks.

スター 41フォーク 6PythonApache-2.0
GitHub
情報の鮮度

分類

Comprehensive LLM evaluation at scale: A production-ready framework for evaluating large language models across multiple benchmarks.

このページのプロジェクト情報と編集内容は無料で読めます。元の GitHub リポジトリが最終的な情報源であり、保存や議論への参加時だけログインが必要です。

コミュニティノート

コミュニティノート