संयुक्त रैंकिंग
देखें कि संयुक्त में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
311/311
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | संयुक्त स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #67 | GPT-5.2 Chat none | OpenAI | 7.3 | 7.9 | $0.594 | 1/2 | 13.9s |
| #161 | Gemini 3.1 Flash Lite low | 3.2 | 6.6 | $0.621 | 0/2 | 161.2s | |
| #194 | Trinity Large Thinking low | Arcee AI | 5.2 | 6.0 | $0.625 | 0/2 | 291.0s |
| #53 | Gemini 2.5 Flash medium | 10.0 | 8.2 | $0.644 | 2/2 | 84.5s | |
| #3 | Gemini 3.7 Flash high | 10.0 | 9.8 | $0.646 | 2/2 | 57.2s | |
| #159 | Gemini 3.1 Flash Lite Preview low | 3.0 | 6.6 | $0.646 | 0/2 | 160.6s | |
| #17 | Gemini 3.8 Flash medium | 8.7 | 9.1 | $0.653 | 1/2 | 60.3s | |
| #44 | Muse Spark 1.2 low | Meta | 9.8 | 8.4 | $0.655 | 2/2 | 17.0s |
| #108 | Claude Sonnet 4.6 none | Anthropic | 9.8 | 7.3 | $0.661 | 2/2 | 37.5s |
| #21 | Gemini 3.5 Flash medium | 10.0 | 9.0 | $0.665 | 2/2 | 44.4s | |
| #162 | Qwen3.6 35B A3B medium | Qwen | 3.0 | 6.6 | $0.672 | 0/2 | 817.6s |
| #51 | Muse Spark 1.1 low | Meta | 6.6 | 8.3 | $0.673 | 1/2 | 29.4s |
| #204 | Mimo V2 Omni medium | Xiaomi | 5.0 | 5.9 | $0.683 | 1/1 | 25.9s |
| #102 | Kimi K2.7 Code medium | Moonshot AI | 7.3 | 7.4 | $0.687 | 1/2 | 66.0s |
| #54 | Muse Spark 1.3 low | Meta | 7.3 | 8.2 | $0.689 | 1/2 | 25.7s |