पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #108 | Qwen3.5-27B medium | Qwen | 8.2 | 7.5 | $0.982 | 2/3 | 59.6s |
| #180 | Qwen3.6 27B medium | Qwen | 7.7 | 6.5 | $0.577 | 2/3 | 61.1s |
| #134 | Muse Glimmer 30B medium | Meta | 6.0 | 7.2 | $0.211 | 1/3 | 64.7s |
| #131 | Muse Glimmer 30B high | Meta | 6.1 | 7.2 | $0.397 | 1/3 | 64.8s |
| #127 | DeepSeek V4 Flash 0731 medium | DeepSeek | 8.2 | 7.3 | $0.046 | 2/3 | 65.1s |
| #118 | Qwen3.8 2.4T A95B high | Qwen | 10.0 | 7.4 | $2.357 | 3/3 | 65.5s |
| #73 | Muse Spark 1.1 high | Meta | 7.8 | 8.0 | $2.253 | 2/3 | 70.0s |
| #265 | Granite 4.2 8B medium | IBM Granite | 3.1 | 5.2 | $0.008 | 0/3 | 76.0s |
| #269 | Granite 4.2 8B low | IBM Granite | 3.0 | 5.1 | $0.012 | 0/3 | 90.8s |
| #308 | Granite 4.2 8B none | IBM Granite | 3.0 | 4.3 | $0.037 | 0/3 | 107.6s |
| #31 | Qwen3.8 Max (0902) high | Qwen | 10.0 | 8.9 | $2.736 | 3/3 | 134.1s |
| #71 | Muse Glimmer 30B xhigh | Meta | 7.8 | 8.1 | $0.471 | 2/3 | 199.7s |
| #60 | Qwen3.8 27B high | Qwen | 7.6 | 8.4 | ~$0.287 | 2/3 | 199.9s |
| #299 | Granite 4.2 8B high | IBM Granite | 2.9 | 4.6 | $0.135 | 0/3 | 202.7s |
| #243 | Hy4 preview low | Tencent | 5.3 | 5.6 | $1.745 | 0/3 | 238.0s |