Skip to content

Commit f1bc959

Browse files
authored
Link Evaluation Cards in launch post intro
1 parent 9600fed commit f1bc959

1 file changed

Lines changed: 1 addition & 1 deletion

File tree

_posts/2026-06-09-evaluation-cards-launch.md

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -28,7 +28,7 @@ tags:
2828
description: "The EvalEval Coalition launches Evaluation Cards, an open-source live interpretive layer over the AI evaluations reporting ecosystem—surfacing reproducibility, completeness, provenance, and comparability across 100,000+ reported results."
2929
---
3030

31-
Today, [the EvalEval Coalition](https://evalevalai.com/) is beta launching Evaluation Cards, an open-source project for stakeholders across the evaluation ecosystem to improve reproducibility, completeness, provenance, and comparability across AI evaluations. Evaluation Cards includes:
31+
Today, [the EvalEval Coalition](https://evalevalai.com/) is beta launching [Evaluation Cards](https://evalevalai.com/projects/eval-cards/), an open-source project for stakeholders across the evaluation ecosystem to improve reproducibility, completeness, provenance, and comparability across AI evaluations. Evaluation Cards includes:
3232

3333
- An interface to explore the largest and most comprehensive corpus yet assembled, with 101,955 reported evaluation results for 638 benchmarks run by 31 organizations on 5,816 models (as of 9 June 2026) based on our [EvalEval sister project, Every Eval Ever (EEE)](https://evalevalai.com/projects/every-eval-ever/)and [IBM AutoBenchmark Cards](https://research.ibm.com/publications/auto-benchmarkcard-automated-synthesis-of-benchmark-documentation).
3434
- A front end that shows four novel signals about the state of evaluations as a whole: reproducibility, completeness, provenance, and comparability.

0 commit comments

Comments
 (0)