context.vn

cursor Bench31

14 models evaluated

#ModelProviderTypeScore
1Claude Fable 5AnthropicClosedclaude-fable-5
2Claude Opus 5AnthropicClosedclaude-opus-5
3GPT-5.6 SolOpenAIClosedgpt-5-6-sol
4Grok 4.5xAI · Closed66.7%
5GPT-5.6 TerraOpenAI · Closed64.9%
6Claude Opus 4.8Anthropic · Closed62.3%
7Claude Sonnet 5Anthropic · Closed61.5%
8GPT-5.6 LunaOpenAI · Closed61.1%
9GPT-5.5OpenAI · Closed58.4%
10Composer 2.5Cursor · Closed56.1%
11GLM-5.2Z.AI · Open weight55.0%
12Gemini 3.6 FlashGoogle · Closed53.5%
13Kimi K2.7 CodeMoonshot AI · Open weight49.7%
14Gemini 3.5 FlashGoogle · Closed48.8%