पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #81 | Step 3.7 Flash medium | Stepfun | 5.7 | 7.9 | $0.495 | 1/3 | 6.19s |
| #92 | Qwen3.7 Flash high | Qwen | 7.1 | 7.8 | $0.052 | 1/3 | 10.8s |
| #96 | DeepSeek V4 Pro high | DeepSeek | 6.9 | 7.7 | $0.761 | 1/3 | 56.8s |
| #101 | Nemotron 3 Ultra medium | NVIDIA | 5.5 | 7.6 | $0.701 | 1/3 | 3.54s |
| #115 | Kimi K2.7 Code medium | Moonshot AI | 5.9 | 7.4 | $0.655 | 1/3 | 41.0s |
| #117 | LongCat 2.0 medium | Meituan | 5.4 | 7.4 | $0.499 | 1/3 | 8.84s |
| #123 | KAT-Coder-Pro V2.5 low | Kwaipilot | 6.4 | 7.3 | $0.400 | 1/3 | 3.11s |
| #129 | Kimi K2.6 medium | Moonshot AI | 6.0 | 7.2 | $1.247 | 1/3 | 25.1s |
| #131 | Muse Glimmer 30B high | Meta | 6.1 | 7.2 | $0.397 | 1/3 | 64.8s |
| #133 | Qwen3.7 Flash low | Qwen | 7.3 | 7.2 | $0.043 | 1/3 | 9.79s |
| #134 | Muse Glimmer 30B medium | Meta | 6.0 | 7.2 | $0.211 | 1/3 | 64.7s |
| #137 | Step 3.7 Flash low | Stepfun | 5.5 | 7.1 | $0.390 | 1/3 | 1.84s |
| #140 | Grok 4.3 medium | X AI | 5.9 | 7.0 | $0.741 | 1/3 | 22.5s |
| #142 | DeepSeek V3.2 medium | DeepSeek | 7.0 | 7.0 | $0.078 | 1/3 | 37.7s |
| #145 | Mercury 2 medium | Inception | 5.4 | 7.0 | $0.094 | 1/3 | 949ms |