context.vn
Menu

vals Multimodal Index

33 models evaluated

#ModelProviderTypeScore
1Claude Fable 5AnthropicProprietary74.15%
2Claude Opus 5AnthropicProprietary73.90%
3Kimi K3Moonshot AIProprietary73.42%
4GPT-5.6 SolOpenAI · Closedmax reasoning72.64%
5Claude Opus 4.8Anthropic · Closed70.89%
6Muse Spark 1.2Meta · Closed69.80%
7GPT-5.6 LunaOpenAI · Closedmax reasoning69.06%
8Claude Sonnet 5Anthropic · Closed68.83%
9GPT-5.5OpenAI · Closedxhigh reasoning68.07%
10Claude Opus 4.7Anthropic · Closed67.36%
11Muse Spark 1.1Meta · Closedxhigh reasoning66.74%
12Qwen3.8 MaxAlibaba · Open weight65.39%
13Gemini 3.6 FlashGoogle · Closedhigh reasoning65.08%
14GPT-5.6 TerraOpenAI · Closedxhigh reasoning65.07%
15Grok 4.5xAI · Closedhigh reasoning63.42%
16Gemini 3.5 FlashGoogle · Closedhigh reasoning62.93%
17Claude Sonnet 4.6Anthropic · Closed60.57%
18MiniMax M3MiniMax · Open weight59.97%
19Kimi K2.6Moonshot AI · Open weight56.43%
20Gemini 3.1 Pro PreviewGooglehigh reasoning56.07%
21GPT-5.4 miniOpenAI · Closedxhigh reasoning54.22%
22Qwen3.7 PlusAlibaba · Closed53.89%
23MiMo-V2.5Xiaomi · Closed52.77%
24Gemini 3 Flash PreviewGooglehigh reasoning52.19%
25Qwen3.6 PlusAlibaba · Closed51.52%
26Inkling-SmallThinking Machines Lab · Open weight0.99 reasoning50.05%
27InklingThinking Machines Lab · Open weight0.99 reasoning49.40%
28GPT-5.4 nanoOpenAI · Closedhigh reasoning47.64%
29Grok 4.3xAI · Closedhigh reasoning43.29%
30Claude Haiku 4.5 ThinkingAnthropic · Closed42.88%
31Gemini 3.1 Flash Lite PreviewGooglehigh reasoning41.35%
32Grok 4.20 0309 ReasoningxAI39.06%
33Mistral Medium 3.5Mistral AIhigh reasoning34.77%