पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
210/210
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #209 | Step 3.5 Flash none | Stepfun | 0.0 | 2.3 | $0.020 | 0/0 | 0ms |
| #165 | Mistral Small 4 none | Mistral | 3.1 | 5.1 | $0.022 | 0/3 | 399ms |
| #197 | Grok 4.20 none | X AI | 5.3 | 4.1 | $0.057 | 1/3 | 473ms |
| #208 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.0 | 3.2 | $0.000 | 0/3 | 532ms |
| #189 | Mercury 2 none | Inception | 3.1 | 4.6 | $0.030 | 0/3 | 535ms |
| #191 | Grok 4.20 Beta none | X AI | 7.7 | 4.4 | $0.087 | 2/3 | 586ms |
| #118 | Gemini 2.5 Flash none | 7.7 | 6.2 | $0.017 | 2/3 | 604ms | |
| #201 | Granite 4.1 8B none | IBM Granite | 3.2 | 4.0 | $0.007 | 0/3 | 608ms |
| #169 | Qwen3.5-9B none | Qwen | 3.2 | 5.1 | $0.021 | 0/3 | 621ms |
| #205 | Laguna Xs.2 none | Poolside | 5.3 | 3.8 | $0.004 | 1/3 | 650ms |
| #122 | Gemini 3.1 Flash Lite none | 6.3 | 6.1 | $0.046 | 1/3 | 720ms | |
| #156 | Gemma 4 26B A4B none | 6.2 | 5.5 | $0.015 | 1/3 | 744ms | |
| #159 | GPT-5.6 Luna none | OpenAI | 5.3 | 5.4 | $0.142 | 1/3 | 790ms |
| #193 | Elephant Alpha none | Openrouter | 4.2 | 4.3 | $0.000 | 0/3 | 807ms |
| #136 | GPT-5.4 Mini none | OpenAI | 5.4 | 5.9 | $0.095 | 1/3 | 836ms |