context.vn

deep Search Qa

12 models evaluated

#ModelProviderTypeScore
1Claude Opus 5AnthropicClosedclaude-opus-5
2Kimi K3Moonshot AIClosedkimi-3
3Claude Opus 4.8AnthropicClosedclaude-opus-4-8
4Step 3.7 FlashStepFun · Open weight92.8%
5Kimi K2.6Moonshot AI · Open weight92.5%
6Muse Spark 1.1Meta · Closed84.9%
7Kimi K2.5Moonshot AI · Open weight77.1%
8Muse SparkMeta · Closed74.8%
9Claude Opus 4.6Anthropic · Closed73.7%
10GPT-5.4OpenAI · Closed73.6%
11Gemini 3.1 ProGoogle · Closed69.7%
12Grok 4.20xAI · Closed62.8%