context.vn
Menu

humaneval

2 models evaluated

#ModelProviderTypeScore
1BTL-3Bad Theory LabsOpen weights95.1%
3Soofi S 30B-A3BSoofi ProjectOpen weights73.8%