पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #329 | Step 3.5 Flash none | Stepfun | 0.0 | 2.3 | $0.020 | 0/0 | 0ms |
| #267 | Mistral Small 4 none | Mistral | 3.1 | 5.1 | $0.022 | 0/3 | 399ms |
| #310 | Grok 4.20 none | X AI | 5.3 | 4.1 | $0.057 | 1/3 | 473ms |
| #318 | Mercury 2.5 none | Inception | 3.7 | 3.9 | $0.016 | 0/3 | 515ms |
| #327 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.0 | 3.2 | $0.000 | 0/3 | 532ms |
| #298 | Mercury 2 none | Inception | 3.1 | 4.7 | $0.030 | 0/3 | 535ms |
| #328 | Jev 1.13 none | Typesafe | 3.3 | 3.2 | $0.003 | 1/1 | 573ms |
| #303 | Grok 4.20 Beta none | X AI | 7.7 | 4.4 | $0.087 | 2/3 | 586ms |
| #210 | Gemini 2.5 Flash none | 7.7 | 6.0 | $0.017 | 2/3 | 604ms | |
| #315 | Granite 4.1 8B none | IBM Granite | 3.2 | 4.0 | $0.007 | 0/3 | 608ms |
| #273 | Qwen3.5-9B none | Qwen | 3.2 | 5.1 | $0.021 | 0/3 | 621ms |
| #324 | Laguna Xs.2 none | Poolside | 5.3 | 3.8 | $0.004 | 1/3 | 650ms |
| #257 | Inkling Small none | Thinkingmachines | 3.2 | 5.3 | $0.054 | 0/3 | 665ms |
| #282 | Mercury 2.5 Preview none | Inception | 5.6 | 4.9 | $0.018 | 1/3 | 684ms |
| #277 | Mercury 2.5 Preview low | Inception | 8.2 | 5.0 | $0.011 | 2/3 | 710ms |