$138.43

Statistics

Cross-model analytics over every completed test series — leaderboards, family deltas, per-criterion strengths and speed/quality trade-offs.

Results
Filters
Families
Models
Tests
Validators
Servers

Normalizing ranks each model against the other models on the same test, so hard tests don't drag scores down.