context.vn

swe Rebench

13 models evaluated

#ModelProviderTypeScore
1Claude Opus 4.6AnthropicClosedclaude-opus-4-6
2GLM-5Z.AIOpenglm-5
3GLM-5.1Z.AIOpenglm-5-1
4DeepSeek V3.2DeepSeek · Open weight60.9%
5Claude Sonnet 4.6Anthropic · Closed60.7%
6Qwen3.5-27BAlibaba · Open weight58.9%
7GLM-4.7Z.AI · Open weight58.7%
8Kimi K2.5Moonshot AI · Open weight58.5%
9GPT-5.3 CodexOpenAI · Closed58.2%
10Composer 2Cursor · Closed58%
11Qwen3.5-35B-A3BAlibaba · Open weight53.7%
12MiniMax M2.7MiniMax · Open weight51.9%
13Gemma 4 31BGoogle · Open weight41.6%