Qwen1.5 110B on MMLU (Massive Multitask Language Understanding): Score Breakdown

Qwen1.5 110B × MMLU (Massive Multitask Language Understanding)

Ergebnisaufschlüsselung

Modell-RankingErgebnis
#14 / 20586.1

Leistungsanalyse

Qwen1.5 110B achieves 86.1 on MMLU (Massive Multitask Language Understanding).