AI BENCHY श्रेणी
संयुक्त रैंकिंग
देखें कि संयुक्त में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
| रैंक | मॉडल | कंपनी | संयुक्त स्कोर | स्कोर | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|
| #59 | GLM 5V Turbo medium | Z.ai | 6.9 | 7.2 | 0/1 | 15.1s |
| #133 | DeepSeek V3.2 none | DeepSeek | 6.5 | 5.2 | 0/1 | 115.9s |
| #48 | Gemini 3 Flash Preview none | 4.7 | 7.4 | 0/1 | 3.56s | |
| #51 | Mimo V2 PRO medium | Xiaomi | 4.7 | 7.4 | 0/1 | 64.7s |
| #66 | Qwen3.5-35B-A3B medium | Qwen | 4.7 | 7.1 | 0/1 | 75.3s |
| #79 | Hunter Alpha medium | OpenRouter | 4.7 | 6.7 | 0/1 | 30.5s |
| #130 | MiniMax M2.7 medium | Minimax | 4.7 | 5.3 | 0/1 | 41.0s |
| #129 | MiniMax M2.5 medium | Minimax | 4.5 | 5.3 | 0/1 | 60.4s |
| #139 | DeepSeek V4 Flash none | DeepSeek | 4.5 | 5.0 | 0/1 | 112.0s |
| #16 | Gemini 3 Flash Preview low | 3.0 | 8.4 | 0/1 | 3.27s | |
| #20 | Gemini 3.5 Flash none | 3.0 | 8.1 | 0/1 | 0ms | |
| #27 | Gemma 4 31B medium | 3.0 | 7.8 | 0/1 | 0ms | |
| #32 | Gemini 3.5 Flash minimal | 3.0 | 7.7 | 0/1 | 3.56s | |
| #34 | Qwen3.7 Max none | Qwen | 3.0 | 7.7 | 0/1 | 2.17s |
| #35 | Gemini 3 PRO Preview medium | 3.0 | 7.6 | 0/1 | 10.4s |