पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #208 | Nemotron 3 Ultra none | NVIDIA | 5.9 | 6.1 | $0.093 | 1/3 | 1.06s |
| #219 | Mimo V2 Omni medium | Xiaomi | 5.9 | 5.9 | $0.683 | 1/3 | 2.38s |
| #276 | MiniMax M2.7 medium | Minimax | 5.9 | 5.0 | $0.208 | 1/3 | 24.9s |
| #149 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 5.9 | 6.9 | $0.478 | 1/3 | 3.20s |
| #271 | Mercury 2.5 low | Inception | 5.9 | 5.1 | $0.011 | 1/3 | 792ms |
| #197 | Gemini 3.1 Flash Lite minimal | 6.0 | 6.1 | $0.047 | 1/3 | 2.15s | |
| #246 | Qwen3.8 27B none | Qwen | 6.0 | 5.5 | ~$0.006 | 1/3 | 1.25s |
| #239 | Mimo V2 PRO none | Xiaomi | 6.0 | 5.6 | $0.045 | 1/3 | 1.61s |
| #76 | GLM 5.2 high | Z.ai | 6.0 | 8.0 | $1.721 | 1/3 | 33.7s |
| #134 | Muse Glimmer 30B medium | Meta | 6.0 | 7.2 | $0.211 | 1/3 | 64.7s |
| #129 | Kimi K2.6 medium | Moonshot AI | 6.0 | 7.2 | $1.247 | 1/3 | 25.1s |
| #196 | Claude Sonnet 5 none | Anthropic | 6.0 | 6.1 | $0.548 | 1/3 | 3.22s |
| #325 | gpt-oss-120b none | OpenAI | 6.0 | 3.7 | $0.033 | 1/3 | 8.21s |
| #131 | Muse Glimmer 30B high | Meta | 6.1 | 7.2 | $0.397 | 1/3 | 64.8s |
| #294 | Hunter Alpha medium | OpenRouter | 6.1 | 4.7 | $0.000 | 1/3 | 5.35s |