AI BENCHY श्रेणी
कोडिंग रैंकिंग
देखें कि कोडिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
| रैंक | मॉडल | कंपनी | कोडिंग स्कोर | स्कोर | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|
| #126 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 3.3 | 5.4 | 0/1 | 38.1s |
| #127 | GLM 5 Turbo none | Z.ai | 4.4 | 5.3 | 0/2 | 2.58s |
| #129 | Laguna Xs.2 none | Poolside | 2.5 | 5.3 | 0/1 | 1.96s |
| #131 | Elephant Alpha none | Openrouter | 4.7 | 5.2 | 0/2 | 1.39s |
| #132 | DeepSeek V4 Flash none | DeepSeek | 4.8 | 5.1 | 0/2 | 24.5s |
| #133 | Qwen3 Coder Next none | Qwen | 5.4 | 5.1 | 0/2 | 2.01s |
| #134 | Nemotron 3 Super none | NVIDIA | 3.4 | 5.0 | 0/2 | 3.02s |
| #135 | Mistral Small 4 none | Mistral | 4.0 | 5.0 | 0/2 | 1.03s |
| #139 | GPT-4o-mini none | OpenAI | 3.2 | 4.9 | 0/2 | 2.05s |
| #140 | Trinity Large Preview none | Arcee AI | 4.9 | 4.8 | 0/1 | 14.3s |
| #141 | GPT-5.4 Nano none | OpenAI | 5.4 | 4.8 | 0/2 | 1.09s |
| #142 | Qwen3 Coder Next medium | Qwen | 4.1 | 4.7 | 0/2 | 1.17s |
| #143 | Qwen3.5-9B none | Qwen | 4.4 | 4.7 | 0/2 | 5.39s |
| #144 | MiMo-V2-Flash none | Xiaomi | 4.9 | 4.7 | 0/2 | 2.04s |
| #146 | Mercury 2 none | Inception | 3.5 | 4.6 | 0/2 | 831ms |