पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #131 | Muse Glimmer 30B high | Meta | 6.1 | 7.2 | $0.397 | 1/3 | 64.8s |
| #294 | Hunter Alpha medium | OpenRouter | 6.1 | 4.7 | $0.000 | 1/3 | 5.35s |
| #129 | Kimi K2.6 medium | Moonshot AI | 6.0 | 7.2 | $1.247 | 1/3 | 25.1s |
| #196 | Claude Sonnet 5 none | Anthropic | 6.0 | 6.1 | $0.548 | 1/3 | 3.22s |
| #325 | gpt-oss-120b none | OpenAI | 6.0 | 3.7 | $0.033 | 1/3 | 8.21s |
| #76 | GLM 5.2 high | Z.ai | 6.0 | 8.0 | $1.721 | 1/3 | 33.7s |
| #134 | Muse Glimmer 30B medium | Meta | 6.0 | 7.2 | $0.211 | 1/3 | 64.7s |
| #239 | Mimo V2 PRO none | Xiaomi | 6.0 | 5.6 | $0.045 | 1/3 | 1.61s |
| #246 | Qwen3.8 27B none | Qwen | 6.0 | 5.5 | ~$0.006 | 1/3 | 1.25s |
| #197 | Gemini 3.1 Flash Lite minimal | 6.0 | 6.1 | $0.047 | 1/3 | 2.15s | |
| #271 | Mercury 2.5 low | Inception | 5.9 | 5.1 | $0.011 | 1/3 | 792ms |
| #149 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 5.9 | 6.9 | $0.478 | 1/3 | 3.20s |
| #140 | Grok 4.3 medium | X AI | 5.9 | 7.0 | $0.741 | 1/3 | 22.5s |
| #190 | Ring-2.6-1T medium | Inclusionai | 5.9 | 6.4 | $0.102 | 1/3 | 20.7s |
| #208 | Nemotron 3 Ultra none | NVIDIA | 5.9 | 6.1 | $0.093 | 1/3 | 1.06s |