पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #243 | Hy4 preview low | Tencent | 5.3 | 5.6 | $1.745 | 0/3 | 238.0s |
| #299 | Granite 4.2 8B high | IBM Granite | 2.9 | 4.6 | $0.135 | 0/3 | 202.7s |
| #60 | Qwen3.8 27B high | Qwen | 7.6 | 8.4 | ~$0.287 | 2/3 | 199.9s |
| #71 | Muse Glimmer 30B xhigh | Meta | 7.8 | 8.1 | $0.471 | 2/3 | 199.7s |
| #31 | Qwen3.8 Max (0902) high | Qwen | 10.0 | 8.9 | $2.736 | 3/3 | 134.1s |
| #308 | Granite 4.2 8B none | IBM Granite | 3.0 | 4.3 | $0.037 | 0/3 | 107.6s |
| #269 | Granite 4.2 8B low | IBM Granite | 3.0 | 5.1 | $0.012 | 0/3 | 90.8s |
| #265 | Granite 4.2 8B medium | IBM Granite | 3.1 | 5.2 | $0.008 | 0/3 | 76.0s |
| #73 | Muse Spark 1.1 high | Meta | 7.8 | 8.0 | $2.253 | 2/3 | 70.0s |
| #118 | Qwen3.8 2.4T A95B high | Qwen | 10.0 | 7.4 | $2.357 | 3/3 | 65.5s |
| #127 | DeepSeek V4 Flash 0731 medium | DeepSeek | 8.2 | 7.3 | $0.046 | 2/3 | 65.1s |
| #131 | Muse Glimmer 30B high | Meta | 6.1 | 7.2 | $0.397 | 1/3 | 64.8s |
| #134 | Muse Glimmer 30B medium | Meta | 6.0 | 7.2 | $0.211 | 1/3 | 64.7s |
| #180 | Qwen3.6 27B medium | Qwen | 7.7 | 6.5 | $0.577 | 2/3 | 61.1s |
| #108 | Qwen3.5-27B medium | Qwen | 8.2 | 7.5 | $0.982 | 2/3 | 59.6s |