पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #303 | Grok 4.20 Beta none | X AI | 7.7 | 4.4 | $0.087 | 2/3 | 586ms |
| #60 | Qwen3.8 27B high | Qwen | 7.6 | 8.4 | ~$0.287 | 2/3 | 199.9s |
| #65 | Claude Fable 5.1 medium | Anthropic | 7.6 | 8.3 | $2.909 | 2/3 | 5.70s |
| #99 | GPT-5.6 Luna high | OpenAI | 7.6 | 7.6 | $0.179 | 2/3 | 14.6s |
| #125 | Gemini 3.1 Flash Lite medium | 7.6 | 7.3 | $0.120 | 2/3 | 1.95s | |
| #172 | Gemini 3.5 Flash Lite low | 7.6 | 6.6 | $0.138 | 2/3 | 1.19s | |
| #195 | GPT-5.6 Luna low | OpenAI | 7.6 | 6.2 | $0.051 | 2/3 | 3.59s |
| #279 | DeepSeek V3.2 none | DeepSeek | 7.6 | 5.0 | $0.054 | 2/3 | 6.91s |
| #59 | GPT-5.2 medium | OpenAI | 7.5 | 8.4 | $1.182 | 2/3 | 5.80s |
| #133 | Qwen3.7 Flash low | Qwen | 7.3 | 7.2 | $0.043 | 1/3 | 9.79s |
| #92 | Qwen3.7 Flash high | Qwen | 7.1 | 7.8 | $0.052 | 1/3 | 10.8s |
| #151 | Qwen3.7 Flash medium | Qwen | 7.1 | 6.9 | $0.065 | 1/3 | 8.30s |
| #142 | DeepSeek V3.2 medium | DeepSeek | 7.0 | 7.0 | $0.078 | 1/3 | 37.7s |
| #72 | Inkling high | Thinkingmachines | 6.9 | 8.0 | $1.046 | 1/3 | 10.7s |
| #96 | DeepSeek V4 Pro high | DeepSeek | 6.9 | 7.7 | $0.761 | 1/3 | 56.8s |