पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #96 | DeepSeek V4 Pro high | DeepSeek | 6.9 | 7.7 | $0.761 | 1/3 | 56.8s |
| #101 | Nemotron 3 Ultra medium | NVIDIA | 5.5 | 7.6 | $0.701 | 1/3 | 3.54s |
| #115 | Kimi K2.7 Code medium | Moonshot AI | 5.9 | 7.4 | $0.655 | 1/3 | 41.0s |
| #117 | LongCat 2.0 medium | Meituan | 5.4 | 7.4 | $0.499 | 1/3 | 8.84s |
| #123 | KAT-Coder-Pro V2.5 low | Kwaipilot | 6.4 | 7.3 | $0.400 | 1/3 | 3.11s |
| #129 | Kimi K2.6 medium | Moonshot AI | 6.0 | 7.2 | $1.247 | 1/3 | 25.1s |
| #131 | Muse Glimmer 30B high | Meta | 6.1 | 7.2 | $0.397 | 1/3 | 64.8s |
| #133 | Qwen3.7 Flash low | Qwen | 7.3 | 7.2 | $0.043 | 1/3 | 9.79s |
| #134 | Muse Glimmer 30B medium | Meta | 6.0 | 7.2 | $0.211 | 1/3 | 64.7s |
| #137 | Step 3.7 Flash low | Stepfun | 5.5 | 7.1 | $0.390 | 1/3 | 1.84s |
| #140 | Grok 4.3 medium | X AI | 5.9 | 7.0 | $0.741 | 1/3 | 22.5s |
| #142 | DeepSeek V3.2 medium | DeepSeek | 7.0 | 7.0 | $0.078 | 1/3 | 37.7s |
| #145 | Mercury 2 medium | Inception | 5.4 | 7.0 | $0.094 | 1/3 | 949ms |
| #148 | Kimi K2.5 medium | Moonshot AI | 5.3 | 7.0 | $0.479 | 1/3 | 43.2s |
| #149 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 5.9 | 6.9 | $0.478 | 1/3 | 3.20s |