संयुक्त रैंकिंग
देखें कि संयुक्त में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | संयुक्त स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #56 | Kimi K2.7 Code medium | Moonshot AI | 7.3 | 7.5 | $0.740 | 1/2 | 66.0s |
| #3 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.742 | 2/2 | 26.7s | |
| #94 | Qwen3.6 35B A3B medium | Qwen | 3.0 | 6.7 | $0.746 | 0/2 | 817.6s |
| #137 | Grok 4.20 Beta medium | X AI | 5.0 | 6.0 | $0.750 | 1/1 | 20.9s |
| #60 | GPT-5.4 Mini medium | OpenAI | 6.9 | 7.5 | $0.756 | 1/2 | 59.6s |
| #55 | Nemotron 3 Ultra medium | NVIDIA | 6.3 | 7.5 | $0.774 | 1/2 | 218.2s |
| #79 | Grok 4.20 medium | X AI | 8.7 | 7.1 | $0.777 | 1/2 | 42.2s |
| #105 | Qwen3.6 27B medium | Qwen | 6.7 | 6.5 | $0.779 | 0/2 | 584.1s |
| #77 | Grok 4.3 medium | X AI | 6.5 | 7.1 | $0.779 | 1/2 | 55.1s |
| #35 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $0.817 | 2/2 | 321.5s |
| #1 | Gemini 3.6 Flash medium | 10.0 | 9.9 | $0.831 | 2/2 | 42.1s | |
| #125 | Qwen3.5-35B-A3B medium | Qwen | 3.8 | 6.2 | $0.837 | 0/2 | 512.8s |
| #16 | GPT-5.3-Codex medium | OpenAI | 10.0 | 8.9 | $0.920 | 2/2 | 26.0s |
| #26 | Claude Sonnet 5 medium | Anthropic | 7.3 | 8.3 | $0.922 | 1/2 | 51.9s |
| #23 | Grok 4.5 low | X AI | 6.5 | 8.4 | $0.935 | 1/2 | 12.8s |