संयुक्त रैंकिंग
देखें कि संयुक्त में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
210/210
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | संयुक्त स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #53 | GPT-5.4 Nano medium | OpenAI | 9.9 | 7.5 | $0.138 | 2/2 | 32.2s |
| #54 | GPT-5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.571 | 2/2 | 15.1s |
| #63 | Claude Sonnet 4.6 none | Anthropic | 9.8 | 7.3 | $0.661 | 2/2 | 37.5s |
| #66 | Claude Opus 4.8 none | Anthropic | 9.8 | 7.3 | $1.166 | 2/2 | 26.4s |
| #71 | Qwen3.7 Plus none | Qwen | 10.0 | 7.2 | $0.106 | 2/2 | 117.7s |
| #74 | GLM 5.1 medium | Z.ai | 9.8 | 7.1 | $0.535 | 2/2 | 175.9s |
| #91 | LongCat 2.0 low | Meituan | 10.0 | 6.7 | $0.391 | 2/2 | 130.2s |
| #94 | Claude Opus 4.7 none | Anthropic | 4.8 | 6.6 | $0.505 | 1/1 | 18.3s |
| #97 | LongCat 2.0 high | Meituan | 10.0 | 6.6 | $0.469 | 2/2 | 167.1s |
| #100 | Hy3 preview medium | Tencent | 5.0 | 6.5 | $0.018 | 1/1 | 46.0s |
| #113 | MiMo-V2-Flash medium | Xiaomi | 4.9 | 6.3 | $0.043 | 1/1 | 75.7s |
| #131 | Grok 4.20 Beta medium | X AI | 5.0 | 6.0 | $0.750 | 1/1 | 20.9s |
| #134 | Mimo V2 Omni medium | Xiaomi | 5.0 | 5.9 | $0.683 | 1/1 | 25.9s |
| #135 | Hy3 preview high | Tencent | 5.0 | 5.9 | $0.048 | 1/1 | 113.1s |
| #143 | Gemini 3.1 Flash Lite high | 5.0 | 5.6 | $2.044 | 1/1 | 149.2s |