MMLU-Pro

By

maalis 20, 2026
Benchmark

Harder MMLU variant focused on expert-level knowledge and reasoning.

Kärkitulos 87,5 %
Mediaani 77,3 %
Tuloshaitari 74,7 % - 87,5 %

Tulostaulukko

Näytä vain ajantasaiset mallit

Oletuksena mukana ovat vain ajantasaiset julkiset mallit. Avaa halutessasi myös vanhemmat ja poistuvat rivit.

SijaMalliTulosLähde
#187,5 % xAI · Päivitetty 21.3.2026
#2
Grok 3 xAI
79,9 % xAI · Päivitetty 21.3.2026
#3
ChatGPT-4o OpenAI
74,7 % Varmennettu lähde · Päivitetty 21.3.2026
#4
GPT-4o OpenAI
74,7 % Varmennettu lähde · Päivitetty 21.3.2026

Tietoa benchmarkista

Päivitetty
21.3.2026

By