context.vn

simple Vqa

8 models evaluated

#ModelProviderTypeScore
1Qwen3.7 PlusAlibabaClosedqwen3-7-plus
2Step 3.7 FlashStepFunOpenstep-3-7-flash
3Gemini 3.1 ProGoogleClosedgemini-3-1-pro
4Muse SparkMeta · Closed71.3%
5GPT-5.4OpenAI · Closed61.1%
6Qwen3.6-35B-A3BAlibaba · Open weight58.9%
7Grok 4.20xAI · Closed57.4%
8Qwen3.6-27BAlibaba · Open weight56.1%