Models scored

27

evaluated

Modality

text

Category

general

+1 more

Published

Search

#ModelLabScore
01Nemotron 3 Ultra (550B A55B)NVIDIA82
02Hermes 3 70BNous Research81
03Nova 2 ProAmazon80
04Qwen3.7-PlusAlibaba Cloud / Qwen Team79
05Qwen3.7 MaxAlibaba Cloud / Qwen Team79
06Qwen3.5-27BAlibaba Cloud / Qwen Team77
07Qwen3.5-397B-A17BAlibaba Cloud / Qwen Team77
08Qwen3.5-122B-A10BAlibaba Cloud / Qwen Team76
09MAI-Code-1-FlashMicrosoft75
10Qwen3.6 PlusAlibaba Cloud / Qwen Team74
11Command A+Cohere74
12Nemotron 3 Super (120B A12B)NVIDIA73
13Mercury 2Inception71
14Nova 2 LiteAmazon71
15Qwen3.5-35B-A3BAlibaba Cloud / Qwen Team70
16MiniMax M2.1MiniMax70
17GPT OSS 120B HighOpenAI70
18MAI-Thinking-1Microsoft69
19Mistral Medium 3.5Mistral AI69
20Nova 2 OmniAmazon69
21K-EXAONE-236B-A23BLG AI Research67
22Qwen3.5-9BAlibaba Cloud / Qwen Team65
23Qwen3.5-4BAlibaba Cloud / Qwen Team59
24Mistral Small 4Mistral AI48
25Qwen3.5-2BAlibaba Cloud / Qwen Team41
26Nova 2 SonicAmazon38
27Qwen3.5-0.8BAlibaba Cloud / Qwen Team21

27 of 27 models · score normalized 0–100 where available

© 2026 NYSGPT2525 LLC