Scientific LLM Benchmarks
GitHub
← All benchmarks
Math· olympiad-proof

IMO-Bench

Google DeepMind · 2025

Olympiad-level suite testing final answers, proof-writing, grading, and Lean formal proofs, vetted by IMO medalists.

Mathematics
GitHub stars
Task type
proof
Modality
text
Access
open
Size
460 items
License
CC-BY-4.0
Metrics
accuracy, grading score

Examples

No sample rows available for this dataset.