पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #52 | DeepSeek V4.1 Flash low | DeepSeek | 8.2 | 8.5 | $0.448 | 2/3 | 9.39s |
| #75 | DeepSeek V4 Flash 0731 high | DeepSeek | 8.2 | 8.0 | $0.058 | 2/3 | 9.36s |
| #108 | Qwen3.5-27B medium | Qwen | 8.2 | 7.5 | $0.982 | 2/3 | 59.6s |
| #8 | GPT-5.6 Sol low | OpenAI | 8.2 | 9.5 | $0.357 | 2/3 | 3.44s |
| #13 | GPT-5.6 Sol medium | OpenAI | 8.2 | 9.4 | $0.508 | 2/3 | 2.98s |
| #34 | Pareto none | Unbiased | 8.2 | 8.9 | $1.172 | 2/3 | 18.2s |
| #51 | GPT-5.4 medium | OpenAI | 8.2 | 8.5 | $1.560 | 2/3 | 9.14s |
| #67 | Muse Spark 1.3 low | Meta | 8.2 | 8.2 | $0.689 | 2/3 | 11.3s |
| #85 | Gemini 3.5 Flash Lite medium | 8.2 | 7.8 | $0.272 | 2/3 | 1.82s | |
| #86 | GLM 5.2 medium | Z.ai | 8.2 | 7.8 | $0.324 | 2/3 | 13.1s |
| #97 | DeepSeek V4 Flash 0423 high | DeepSeek | 8.2 | 7.6 | $0.042 | 2/3 | 26.1s |
| #122 | GLM 5.3 high | Z.ai | 8.2 | 7.3 | $0.403 | 2/3 | 4.74s |
| #130 | KAT-Coder-Pro V2.5 high | Kwaipilot | 8.2 | 7.2 | $0.506 | 2/3 | 3.38s |
| #132 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 8.2 | 7.2 | $0.323 | 2/3 | 17.7s |
| #143 | GLM 5.1 medium | Z.ai | 8.2 | 7.0 | $0.727 | 2/3 | 31.6s |