संयुक्त रैंकिंग
देखें कि संयुक्त में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | संयुक्त स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #136 | Step 3.5 Flash medium | Stepfun | 6.5 | 6.0 | $0.108 | 1/2 | 813.7s |
| #142 | GPT-5.4 Mini none | OpenAI | 6.5 | 5.9 | $0.095 | 1/2 | 6.22s |
| #150 | KAT-Coder-Air V2.5 high | Kwaipilot | 6.5 | 5.6 | $0.077 | 1/2 | 74.5s |
| #155 | KAT-Coder-Air V2.5 medium | Kwaipilot | 6.5 | 5.6 | $0.048 | 1/2 | 19.6s |
| #168 | Ling-2.6-1T none | Inclusionai | 6.5 | 5.3 | $0.016 | 1/2 | 23.8s |
| #27 | Muse Spark 1.1 low | Meta | 6.6 | 8.3 | $0.647 | 1/2 | 29.4s |
| #81 | Kimi K2.5 medium | Moonshot AI | 6.7 | 7.0 | $0.600 | 1/2 | 89.2s |
| #82 | Mercury 2 medium | Inception | 6.7 | 7.0 | $0.093 | 1/2 | 7.84s |
| #105 | Qwen3.6 27B medium | Qwen | 6.7 | 6.5 | $0.779 | 0/2 | 584.1s |
| #60 | GPT-5.4 Mini medium | OpenAI | 6.9 | 7.5 | $0.756 | 1/2 | 59.6s |
| #61 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 6.9 | 7.5 | $0.437 | 1/2 | 175.8s |
| #72 | Kimi K2.6 medium | Moonshot AI | 6.9 | 7.2 | $1.036 | 1/2 | 458.6s |
| #88 | MiMo-V2.5-Pro medium | Xiaomi | 6.9 | 6.9 | $0.187 | 1/2 | 125.4s |
| #101 | GLM 5.2 none | Z.ai | 6.9 | 6.6 | $0.128 | 1/2 | 50.2s |
| #68 | Gemini 3.1 Flash Lite Preview medium | 7.2 | 7.3 | $0.115 | 1/2 | 16.6s |