पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #277 | Mercury 2.5 Preview low | Inception | 8.2 | 5.0 | $0.011 | 2/3 | 710ms |
| #282 | Mercury 2.5 Preview none | Inception | 5.6 | 4.9 | $0.018 | 1/3 | 684ms |
| #257 | Inkling Small none | Thinkingmachines | 3.2 | 5.3 | $0.054 | 0/3 | 665ms |
| #324 | Laguna Xs.2 none | Poolside | 5.3 | 3.8 | $0.004 | 1/3 | 650ms |
| #273 | Qwen3.5-9B none | Qwen | 3.2 | 5.1 | $0.021 | 0/3 | 621ms |
| #315 | Granite 4.1 8B none | IBM Granite | 3.2 | 4.0 | $0.007 | 0/3 | 608ms |
| #210 | Gemini 2.5 Flash none | 7.7 | 6.0 | $0.017 | 2/3 | 604ms | |
| #303 | Grok 4.20 Beta none | X AI | 7.7 | 4.4 | $0.087 | 2/3 | 586ms |
| #328 | Jev 1.13 none | Typesafe | 3.3 | 3.2 | $0.003 | 1/1 | 573ms |
| #298 | Mercury 2 none | Inception | 3.1 | 4.7 | $0.030 | 0/3 | 535ms |
| #327 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.0 | 3.2 | $0.000 | 0/3 | 532ms |
| #318 | Mercury 2.5 none | Inception | 3.7 | 3.9 | $0.016 | 0/3 | 515ms |
| #310 | Grok 4.20 none | X AI | 5.3 | 4.1 | $0.057 | 1/3 | 473ms |
| #267 | Mistral Small 4 none | Mistral | 3.1 | 5.1 | $0.022 | 0/3 | 399ms |
| #329 | Step 3.5 Flash none | Stepfun | 0.0 | 2.3 | $0.020 | 0/0 | 0ms |