डोमेन-विशिष्ट रैंकिंग
देखें कि डोमेन-विशिष्ट में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | डोमेन-विशिष्ट स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #103 | Grok Build 0.1 medium | X AI | 2.9 | 7.5 | $1.130 | 0/3 | 175.9s |
| #107 | Kimi K2.7 Code medium | Moonshot AI | 3.7 | 7.4 | $0.687 | 0/3 | 184.2s |
| #108 | GPT-5.6 Luna medium | OpenAI | 2.9 | 7.4 | $0.072 | 0/3 | 18.5s |
| #109 | LongCat 2.0 medium | Meituan | 3.0 | 7.4 | $0.499 | 0/3 | 390.6s |
| #110 | Qwen3.8 2.4T A95B high | Qwen | 4.1 | 7.4 | $2.357 | 0/3 | 301.1s |
| #111 | Grok 4.6 low | X AI | 3.0 | 7.4 | $0.449 | 0/3 | 18.2s |
| #114 | GLM 5.3 high | Z.ai | 2.9 | 7.3 | $0.403 | 0/3 | 112.3s |
| #115 | KAT-Coder-Pro V2.5 low | Kwaipilot | 3.5 | 7.3 | $0.400 | 0/3 | 22.9s |
| #116 | GLM 5.3 Flash high | Z.ai | 3.0 | 7.3 | $0.029 | 0/3 | 85.9s |
| #117 | Gemini 3.1 Flash Lite medium | 2.9 | 7.3 | $0.120 | 0/3 | 3.93s | |
| #119 | DeepSeek V4 Flash 0731 medium | DeepSeek | 2.9 | 7.3 | $0.066 | 0/3 | 203.1s |
| #122 | KAT-Coder-Pro V2.5 high | Kwaipilot | 2.9 | 7.2 | $0.506 | 0/3 | 44.7s |
| #123 | Muse Glimmer 30B high | Meta | 2.9 | 7.2 | $0.397 | 0/3 | 182.6s |
| #124 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 2.9 | 7.2 | $0.323 | 0/3 | 57.4s |
| #125 | Qwen3.7 Flash low | Qwen | 3.6 | 7.2 | $0.043 | 0/3 | 37.6s |