पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #35 | GLM 5.2 high | Z.ai | 6.0 | 8.0 | $0.817 | 1/3 | 33.7s |
| #50 | DeepSeek V4 Pro high | DeepSeek | 6.9 | 7.7 | $0.200 | 1/3 | 56.8s |
| #55 | Nemotron 3 Ultra medium | NVIDIA | 5.5 | 7.5 | $0.774 | 1/3 | 3.54s |
| #56 | Kimi K2.7 Code medium | Moonshot AI | 5.9 | 7.5 | $0.740 | 1/3 | 41.0s |
| #64 | LongCat 2.0 medium | Meituan | 5.4 | 7.4 | $0.478 | 1/3 | 8.84s |
| #66 | KAT-Coder-Pro V2.5 low | Kwaipilot | 6.4 | 7.4 | $0.387 | 1/3 | 3.11s |
| #71 | Step 3.7 Flash low | Stepfun | 5.5 | 7.3 | $0.454 | 1/3 | 1.84s |
| #72 | Kimi K2.6 medium | Moonshot AI | 6.0 | 7.2 | $1.036 | 1/3 | 25.1s |
| #77 | Grok 4.3 medium | X AI | 5.9 | 7.1 | $0.779 | 1/3 | 22.5s |
| #80 | DeepSeek V3.2 medium | DeepSeek | 7.0 | 7.0 | $0.078 | 1/3 | 37.7s |
| #81 | Kimi K2.5 medium | Moonshot AI | 5.3 | 7.0 | $0.600 | 1/3 | 43.2s |
| #82 | Mercury 2 medium | Inception | 5.4 | 7.0 | $0.093 | 1/3 | 949ms |
| #85 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 5.9 | 6.9 | $0.467 | 1/3 | 3.20s |
| #88 | MiMo-V2.5-Pro medium | Xiaomi | 6.7 | 6.9 | $0.187 | 1/3 | 5.31s |
| #90 | Step 3.7 Flash high | Stepfun | 5.3 | 6.9 | $1.207 | 1/3 | 10.2s |