पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
210/210
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #136 | GPT-5.4 Mini none | OpenAI | 5.4 | 5.9 | $0.095 | 1/3 | 836ms |
| #193 | Elephant Alpha none | Openrouter | 4.2 | 4.3 | $0.000 | 0/3 | 807ms |
| #159 | GPT-5.6 Luna none | OpenAI | 5.3 | 5.4 | $0.142 | 1/3 | 790ms |
| #156 | Gemma 4 26B A4B none | 6.2 | 5.5 | $0.015 | 1/3 | 744ms | |
| #122 | Gemini 3.1 Flash Lite none | 6.3 | 6.1 | $0.046 | 1/3 | 720ms | |
| #205 | Laguna Xs.2 none | Poolside | 5.3 | 3.8 | $0.004 | 1/3 | 650ms |
| #169 | Qwen3.5-9B none | Qwen | 3.2 | 5.1 | $0.021 | 0/3 | 621ms |
| #201 | Granite 4.1 8B none | IBM Granite | 3.2 | 4.0 | $0.007 | 0/3 | 608ms |
| #118 | Gemini 2.5 Flash none | 7.7 | 6.2 | $0.017 | 2/3 | 604ms | |
| #191 | Grok 4.20 Beta none | X AI | 7.7 | 4.4 | $0.087 | 2/3 | 586ms |
| #189 | Mercury 2 none | Inception | 3.1 | 4.6 | $0.030 | 0/3 | 535ms |
| #208 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.0 | 3.2 | $0.000 | 0/3 | 532ms |
| #197 | Grok 4.20 none | X AI | 5.3 | 4.1 | $0.057 | 1/3 | 473ms |
| #165 | Mistral Small 4 none | Mistral | 3.1 | 5.1 | $0.022 | 0/3 | 399ms |
| #209 | Step 3.5 Flash none | Stepfun | 0.0 | 2.3 | $0.020 | 0/0 | 0ms |