पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #102 | Claude Opus 5 none | Anthropic | 7.7 | 7.5 | $1.550 | 2/3 | 3.66s |
| #105 | MiniMax M3 medium | Minimax | 7.9 | 7.5 | $0.300 | 2/3 | 49.9s |
| #108 | Qwen3.5-27B medium | Qwen | 8.2 | 7.5 | $0.982 | 2/3 | 59.6s |
| #110 | GPT-5.4 Mini medium | OpenAI | 7.8 | 7.5 | $0.786 | 2/3 | 4.37s |
| #111 | Grok Build 0.1 medium | X AI | 7.7 | 7.5 | $1.130 | 2/3 | 18.3s |
| #113 | Gemini 3.1 Flash Lite Preview medium | 7.7 | 7.4 | $0.117 | 2/3 | 5.30s | |
| #116 | GPT-5.6 Luna medium | OpenAI | 7.8 | 7.4 | $0.072 | 2/3 | 4.04s |
| #121 | Claude Sonnet 4.6 none | Anthropic | 7.7 | 7.3 | $0.661 | 2/3 | 2.53s |
| #122 | GLM 5.3 high | Z.ai | 8.2 | 7.3 | $0.403 | 2/3 | 4.74s |
| #125 | Gemini 3.1 Flash Lite medium | 7.6 | 7.3 | $0.120 | 2/3 | 1.95s | |
| #126 | Qwen3.7 Plus none | Qwen | 7.7 | 7.3 | $0.106 | 2/3 | 1.71s |
| #127 | DeepSeek V4 Flash 0731 medium | DeepSeek | 8.2 | 7.3 | $0.046 | 2/3 | 65.1s |
| #128 | Claude Opus 4.8 none | Anthropic | 7.7 | 7.3 | $1.166 | 2/3 | 2.74s |
| #130 | KAT-Coder-Pro V2.5 high | Kwaipilot | 8.2 | 7.2 | $0.506 | 2/3 | 3.38s |
| #132 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 8.2 | 7.2 | $0.323 | 2/3 | 17.7s |