पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #253 | MiMo-V2.5-Pro none | Xiaomi | 6.7 | 5.4 | $0.068 | 1/3 | 1.30s |
| #161 | MiMo-V2.5-Pro medium | Xiaomi | 6.7 | 6.8 | $0.221 | 1/3 | 5.31s |
| #173 | Qwen3.5-27B none | Qwen | 6.7 | 6.6 | $0.058 | 1/3 | 1.38s |
| #207 | Qwen3.5 Plus 2026-04-20 none | Qwen | 6.7 | 6.1 | $0.122 | 1/3 | 1.97s |
| #290 | Grok 4.20 Multi Agent Beta medium | X AI | 6.7 | 4.8 | $5.599 | 1/3 | 5.19s |
| #206 | Gemma 4 31B none | 6.5 | 6.1 | $0.016 | 1/3 | 4.23s | |
| #123 | KAT-Coder-Pro V2.5 low | Kwaipilot | 6.4 | 7.3 | $0.400 | 1/3 | 3.11s |
| #191 | Mimo V2 PRO medium | Xiaomi | 6.4 | 6.3 | $0.333 | 1/3 | 5.08s |
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 6.4 | 8.5 | $0.574 | 1/3 | 14.3s |
| #292 | GLM 4.7 Flash none | Z.ai | 6.4 | 4.8 | $0.016 | 1/3 | 1.20s |
| #203 | Inkling low | Thinkingmachines | 6.4 | 6.1 | $0.187 | 1/3 | 2.97s |
| #317 | Grok Build 0.1 none | X AI | 6.4 | 4.0 | $0.547 | 1/3 | 9.55s |
| #209 | Trinity Large Thinking low | Arcee AI | 6.3 | 6.0 | $0.625 | 1/3 | 3.28s |
| #201 | Gemini 3.1 Flash Lite none | 6.3 | 6.1 | $0.046 | 1/3 | 720ms | |
| #238 | Gemma 4 26B A4B none | 6.2 | 5.6 | $0.017 | 1/3 | 744ms |