पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #164 | Gemma 4 26B A4B medium | 10.0 | 6.8 | $0.084 | 3/3 | 5.79s | |
| #59 | GPT-5.2 medium | OpenAI | 7.5 | 8.4 | $1.182 | 2/3 | 5.80s |
| #37 | Qwen3.8 Max (0902) medium | Qwen | 10.0 | 8.8 | $0.677 | 3/3 | 5.89s |
| #177 | Qwen3.6 35B A3B medium | Qwen | 8.0 | 6.6 | $0.672 | 2/3 | 5.95s |
| #242 | Nemotron 3.5 Lightning high | NVIDIA | 3.6 | 5.6 | $0.134 | 0/3 | 6.09s |
| #26 | Claude Fable 5.1 high | Anthropic | 10.0 | 9.0 | $3.364 | 3/3 | 6.11s |
| #81 | Step 3.7 Flash medium | Stepfun | 5.7 | 7.9 | $0.495 | 1/3 | 6.19s |
| #287 | Nemotron 3.5 Lightning low | NVIDIA | 3.6 | 4.8 | $0.140 | 0/3 | 6.21s |
| #146 | Grok 4.20 medium | X AI | 7.7 | 7.0 | $0.805 | 2/3 | 6.22s |
| #154 | Qwen3.6 Flash medium | Qwen | 8.2 | 6.8 | $0.741 | 2/3 | 6.29s |
| #84 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 3/3 | 6.34s |
| #283 | Ling-2.6-flash none | Inclusionai | 2.9 | 4.9 | $0.002 | 0/3 | 6.51s |
| #64 | Muse Spark 1.1 low | Meta | 8.3 | 8.3 | $0.673 | 2/3 | 6.60s |
| #28 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $4.163 | 3/3 | 6.76s |
| #18 | Gemini 3.1 Pro Preview medium | 10.0 | 9.2 | $1.352 | 3/3 | 6.90s |