context.vn

mmmu Pro

34 models evaluated

#ModelProviderTypeScore
1GPT-5.4 ProOpenAIClosedgpt-5-4-pro
2Gemini 3.1 ProGoogleClosedgemini-3-1-pro
3Gemini 3.5 FlashGoogleClosedgemini-3-5-flash
4GPT-5.6 SolOpenAI · Closed83%
5Kimi K3Moonshot AI · Closed81.6%
6GPT-5.5OpenAI · Closed81.2%
7GPT-5.4OpenAI · Closed81.2%
8Gemini 3 ProGoogle · Closed81%
9GPT-5.6 TerraOpenAI · Closed80.7%
10Muse SparkMeta · Closed80.4%
11GPT-5.2OpenAI · Closed79.5%
12Kimi K2.6Moonshot AI · Open weight79.4%
13Qwen3.7 PlusAlibaba · Closed79%
14Qwen3.5 397BAlibaba · Open weight79%
15Qwen3.6 PlusAlibaba · Closed78.8%
16Kimi K2.5Moonshot AI · Open weight78.5%
17Kimi K2.5 (Reasoning)Moonshot AI · Closed78.5%
18GPT-5.6 LunaOpenAI · Closed78.4%
19MiniMax M3MiniMax · Open weight78.1%
20Grok 4.3xAI · Closed78.1%
21MiMo-V2.5Xiaomi · Closed77.9%
22Claude Opus 4.6Anthropic · Closed77.3%
23Gemma 4 31BGoogle · Open weight76.9%
24GPT-5.4 miniOpenAI · Closed76.6%
25Qwen3.6-27BAlibaba · Open weight75.8%
26Qwen3.6-35B-A3BAlibaba · Open weight75.3%
27Grok 4.20xAI · Closed75.2%
28Gemma 4 26B A4BGoogle · Open weight73.8%
29InklingThinking Machines Lab · Open weight73.5%
30Interfaze BetaInterfaze · Closed71.1%
31Claude Opus 4.5Anthropic · Closed70.6%
32Gemma 4 12BGoogle · Open weight69.1%
33GPT-5.4 nanoOpenAI · Closed66.1%
34Command A+Cohere · Open weight63%