संयुक्त रैंकिंग
देखें कि संयुक्त में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | संयुक्त स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #85 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 6.4 | 6.9 | $0.467 | 1/2 | 135.7s |
| #86 | DeepSeek V4 Pro none | DeepSeek | 7.9 | 6.9 | $0.096 | 1/2 | 71.6s |
| #87 | GPT-5.6 Sol none | OpenAI | 6.5 | 6.9 | $0.524 | 1/2 | 8.37s |
| #88 | MiMo-V2.5-Pro medium | Xiaomi | 6.9 | 6.9 | $0.187 | 1/2 | 125.4s |
| #89 | Qwen3.6 Flash medium | Qwen | 6.5 | 6.9 | $0.738 | 1/2 | 299.2s |
| #90 | Step 3.7 Flash high | Stepfun | 8.7 | 6.9 | $1.207 | 1/2 | 41.2s |
| #91 | GPT-5.5 none | OpenAI | 6.5 | 6.9 | $0.544 | 1/2 | 8.90s |
| #95 | Gemini 3.5 Flash-Lite low | 6.3 | 6.7 | $0.145 | 1/2 | 8.96s | |
| #100 | Gemma 4 26B A4B medium | 6.3 | 6.6 | $0.089 | 1/2 | 492.9s | |
| #101 | GLM 5.2 none | Z.ai | 6.9 | 6.6 | $0.128 | 1/2 | 50.2s |
| #103 | Qwen3.6 Max Preview none | Qwen | 6.5 | 6.6 | $0.231 | 1/2 | 61.6s |
| #107 | MiMo-V2.5 medium | Xiaomi | 8.7 | 6.5 | $0.082 | 1/2 | 78.0s |
| #108 | Laguna XS 2.1 medium | Poolside | 6.3 | 6.5 | $0.068 | 1/2 | 218.1s |
| #109 | Qwen3.5-27B none | Qwen | 6.4 | 6.5 | $0.090 | 1/2 | 39.4s |
| #113 | Qwen3.5 Plus 2026-02-15 none | Qwen | 6.5 | 6.4 | $0.073 | 1/2 | 64.8s |