context.vn

mmlu

8 models evaluated

#ModelProviderTypeScore
1o1OpenAIClosed91.8%
2GPT-4.1OpenAIClosedgpt-4-1
3DeepSeek V4 Pro BaseDeepSeekOpendeepseek-v4-pro-base
4DeepSeek V4 Flash BaseDeepSeek · Open weight88.7%
5GPT-4.1 miniOpenAI · Closed87.5%
6Trinity-Large-PreviewArcee AI · Open weight87.2%
7o3-miniOpenAI · Closed86.9%
8GPT-4.1 nanoOpenAI · Closed80.1%