context.vn

live Code Bench Pro

8 models evaluated

#ModelProviderTypeScore
1Sakana Fugu-UltraSakana AIClosedsakana-fugu-ultra
2Sakana FuguSakana AIClosedsakana-fugu
3GPT-5.4OpenAIClosedgpt-5-4
4Gemini 3.1 ProGoogle · Closed82.9%
5Muse SparkMeta · Closed80.0%
6Grok 4.20xAI · Closed74.2%
7Claude Opus 4.6Anthropic · Closed70.7%
8MiniCPM5-1BOpenBMB · Open weight22.7%