पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #238 | Gemma 4 26B A4B none | 6.2 | 5.6 | $0.017 | 1/3 | 744ms | |
| #201 | Gemini 3.1 Flash Lite none | 6.3 | 6.1 | $0.046 | 1/3 | 720ms | |
| #209 | Trinity Large Thinking low | Arcee AI | 6.3 | 6.0 | $0.625 | 1/3 | 3.28s |
| #317 | Grok Build 0.1 none | X AI | 6.4 | 4.0 | $0.547 | 1/3 | 9.55s |
| #203 | Inkling low | Thinkingmachines | 6.4 | 6.1 | $0.187 | 1/3 | 2.97s |
| #292 | GLM 4.7 Flash none | Z.ai | 6.4 | 4.8 | $0.016 | 1/3 | 1.20s |
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 6.4 | 8.5 | $0.574 | 1/3 | 14.3s |
| #123 | KAT-Coder-Pro V2.5 low | Kwaipilot | 6.4 | 7.3 | $0.400 | 1/3 | 3.11s |
| #191 | Mimo V2 PRO medium | Xiaomi | 6.4 | 6.3 | $0.333 | 1/3 | 5.08s |
| #206 | Gemma 4 31B none | 6.5 | 6.1 | $0.016 | 1/3 | 4.23s | |
| #161 | MiMo-V2.5-Pro medium | Xiaomi | 6.7 | 6.8 | $0.221 | 1/3 | 5.31s |
| #173 | Qwen3.5-27B none | Qwen | 6.7 | 6.6 | $0.058 | 1/3 | 1.38s |
| #207 | Qwen3.5 Plus 2026-04-20 none | Qwen | 6.7 | 6.1 | $0.122 | 1/3 | 1.97s |
| #290 | Grok 4.20 Multi Agent Beta medium | X AI | 6.7 | 4.8 | $5.599 | 1/3 | 5.19s |
| #253 | MiMo-V2.5-Pro none | Xiaomi | 6.7 | 5.4 | $0.068 | 1/3 | 1.30s |