context.vn

vals Multimodal Index

29 models evaluated

#ModelProviderTypeScore
1Anthropicanthropic/claude-fable-5Claude Fable 574.15%
2Anthropicanthropic/claude-opus-5Claude Opus 573.90%
3Moonshot AIkimi/kimi-k3Kimi K373.42%
4GPT-5.6 SolOpenAI72.19%
5Claude Opus 4.8Anthropic70.89%
6GPT-5.6 LunaOpenAI69.06%
7Claude Sonnet 5Anthropic68.83%
8GPT-5.5OpenAI68.07%
9Claude Opus 4.7Anthropic67.36%
10Muse Spark 1.1Meta66.74%
11GPT-5.6 TerraOpenAI65.07%
12Grok 4.5xAI63.42%
13Gemini 3.5 FlashGoogle62.93%
14Gemini 3.6 FlashGoogle62.80%
15Claude Sonnet 4.6Anthropic60.57%
16MiniMax M3MiniMax59.97%
17Kimi K2.6Moonshot AI56.43%
18Gemini 3.1 Pro PreviewGoogle56.07%
19GPT-5.4 MiniOpenAI54.22%
20Qwen3.7 PlusAlibaba53.89%
21Mimo V2.5Xiaomi52.77%
22Gemini 3 Flash PreviewGoogle52.19%
23Qwen3.6 PlusAlibaba51.52%
24GPT-5.4 NanoOpenAI47.64%
25Grok 4.3xAI43.29%
26Claude Haiku 4.5 20251001 ThinkingAnthropic42.88%
27Gemini 3.1 Flash Lite PreviewGoogle41.35%
28Grok 4.20 0309 ReasoningxAI39.06%
29Mistral Medium 3.5Mistral AI34.77%