evals
openai/evals
Evals is a framework for evaluating LLMs and LLM systems, and an open-source registry of benchmarks.
19,282stars
Forks
3,064
Open issues
324
Watchers
19,282
Size
6.5 MB
PythonOther
Created: Jan 23, 2023
Updated: Aug 27, 2026
Last push: Apr 14, 2026