context.vn
Menu

program Bench

17 models evaluated

#ModelProviderTypeScore
1Claude Opus 5AnthropicProprietary37.0%
2Claude Opus 4.8AnthropicProprietary16.5%
3GPT-5.6 SolOpenAIProprietary15.5%
4GPT-5.5OpenAI · Closed13.5%
5GLM-5.2Z.AI · Open weight8.5%
6Gemini 3.7 FlashGoogle · Closed5.5%
8Claude Opus 4.7Anthropic · Closed4.5%
9Gemini 3.6 FlashGoogle · Closed4.0%
10Gemini 3.5 FlashGoogle · Closed3.0%
13Claude Opus 4.6Anthropic · Closed2.5%
15Claude Sonnet 4.6Anthropic · Closed1.0%
16GPT-5.4OpenAI · Closed0.0%
17Gemini 3.1 ProGoogle · Closed0.0%
18Gemini 3 FlashGoogle · Closed0.0%
19Claude Haiku 4.5Anthropic · Closed0.0%
20GPT-5.4 miniOpenAI · Closed0.0%
21GPT-5 miniOpenAI · Closed0.0%