पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #72 | Inkling high | Thinkingmachines | 6.9 | 8.0 | $1.046 | 1/3 | 10.7s |
| #96 | DeepSeek V4 Pro high | DeepSeek | 6.9 | 7.7 | $0.761 | 1/3 | 56.8s |
| #142 | DeepSeek V3.2 medium | DeepSeek | 7.0 | 7.0 | $0.078 | 1/3 | 37.7s |
| #92 | Qwen3.7 Flash high | Qwen | 7.1 | 7.8 | $0.052 | 1/3 | 10.8s |
| #151 | Qwen3.7 Flash medium | Qwen | 7.1 | 6.9 | $0.065 | 1/3 | 8.30s |
| #133 | Qwen3.7 Flash low | Qwen | 7.3 | 7.2 | $0.043 | 1/3 | 9.79s |
| #59 | GPT-5.2 medium | OpenAI | 7.5 | 8.4 | $1.182 | 2/3 | 5.80s |
| #60 | Qwen3.8 27B high | Qwen | 7.6 | 8.4 | ~$0.287 | 2/3 | 199.9s |
| #65 | Claude Fable 5.1 medium | Anthropic | 7.6 | 8.3 | $2.909 | 2/3 | 5.70s |
| #99 | GPT-5.6 Luna high | OpenAI | 7.6 | 7.6 | $0.179 | 2/3 | 14.6s |
| #125 | Gemini 3.1 Flash Lite medium | 7.6 | 7.3 | $0.120 | 2/3 | 1.95s | |
| #172 | Gemini 3.5 Flash Lite low | 7.6 | 6.6 | $0.138 | 2/3 | 1.19s | |
| #195 | GPT-5.6 Luna low | OpenAI | 7.6 | 6.2 | $0.051 | 2/3 | 3.59s |
| #279 | DeepSeek V3.2 none | DeepSeek | 7.6 | 5.0 | $0.054 | 2/3 | 6.91s |
| #27 | Gemini 3.5 Flash medium | 7.7 | 9.0 | $0.665 | 2/3 | 2.38s |