पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #100 | Solar Pro 4 xhigh | Upstage | 8.9 | 7.6 | $0.150 | 2/3 | 58.0s |
| #96 | DeepSeek V4 Pro high | DeepSeek | 6.9 | 7.7 | $0.761 | 1/3 | 56.8s |
| #138 | Solar Pro 4 high | Upstage | 8.7 | 7.1 | $0.138 | 2/3 | 55.2s |
| #319 | Ling 3.0 Tiny high | Inclusionai | 3.0 | 3.8 | $0.000 | 0/3 | 54.2s |
| #234 | Gemini 3.1 Flash Lite high | 5.7 | 5.6 | $2.044 | 1/3 | 50.8s | |
| #105 | MiniMax M3 medium | Minimax | 7.9 | 7.5 | $0.300 | 2/3 | 49.9s |
| #261 | Gemini 3.1 Flash Lite Preview high | 7.7 | 5.3 | $2.310 | 2/3 | 46.7s | |
| #158 | Solar Pro 4 medium | Upstage | 9.0 | 6.8 | $0.140 | 2/3 | 45.8s |
| #69 | Qwen3.8 2.4T A95B low | Qwen | 10.0 | 8.1 | $2.672 | 3/3 | 43.4s |
| #148 | Kimi K2.5 medium | Moonshot AI | 5.3 | 7.0 | $0.479 | 1/3 | 43.2s |
| #47 | Muse Spark 1.1 medium | Meta | 7.9 | 8.6 | $1.420 | 2/3 | 42.5s |
| #157 | Solar Pro 4 low | Upstage | 9.0 | 6.8 | $0.130 | 2/3 | 42.1s |
| #115 | Kimi K2.7 Code medium | Moonshot AI | 5.9 | 7.4 | $0.655 | 1/3 | 41.0s |
| #33 | Muse Spark 1.3 high | Meta | 8.7 | 8.9 | $1.653 | 2/3 | 38.4s |
| #142 | DeepSeek V3.2 medium | DeepSeek | 7.0 | 7.0 | $0.078 | 1/3 | 37.7s |