context.vn

med Xpert Qa Mm

7 models evaluated

#ModelProviderTypeScore
1Gemini 3.1 ProGoogleClosedgemini-3-1-pro
2Muse SparkMetaClosedmuse-spark
3GPT-5.4OpenAIClosedgpt-5-4
4Qwen3.7 PlusAlibaba · Closed71.0%
5Grok 4.20xAI · Closed65.8%
6Claude Opus 4.6Anthropic · Closed64.8%
7Gemma 4 12BGoogle · Open weight48.7%