पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #104 | GPT-5.6 Terra low | OpenAI | 10.0 | 7.5 | $0.420 | 3/3 | 4.46s |
| #5 | GPT-6 Astra xhigh | OpenAI | 10.0 | 9.9 | $5.156 | 3/3 | 4.48s |
| #23 | Qwen3.8 Max (0902) low | Qwen | 10.0 | 9.1 | $0.664 | 3/3 | 4.49s |
| #312 | Hy3 preview none | Tencent | 3.1 | 4.0 | $0.007 | 0/3 | 4.56s |
| #20 | Claude Opus 5 high | Anthropic | 10.0 | 9.2 | $3.070 | 3/3 | 4.66s |
| #95 | Claude Opus 4.6 medium | Anthropic | 7.7 | 7.7 | $2.961 | 2/3 | 4.71s |
| #16 | GPT-5.5 low | OpenAI | 10.0 | 9.3 | $1.257 | 3/3 | 4.74s |
| #122 | GLM 5.3 high | Z.ai | 8.2 | 7.3 | $0.403 | 2/3 | 4.74s |
| #150 | Claude Fable 5.1 low | Anthropic | 7.7 | 6.9 | $2.565 | 2/3 | 4.78s |
| #82 | Qwen3.8 27B low | Qwen | 7.7 | 7.9 | ~$0.071 | 2/3 | 4.91s |
| #29 | Qwen3.8 Max medium | Qwen | 10.0 | 9.0 | $0.771 | 3/3 | 4.93s |
| #32 | GPT-5.3-Codex medium | OpenAI | 9.0 | 8.9 | $0.988 | 2/3 | 5.05s |
| #136 | Muse Glimmer 30B low | Meta | 7.7 | 7.1 | $0.143 | 2/3 | 5.06s |
| #191 | Mimo V2 PRO medium | Xiaomi | 6.4 | 6.3 | $0.333 | 1/3 | 5.08s |
| #244 | Qwen3.6 27B none | Qwen | 5.3 | 5.5 | $0.062 | 1/3 | 5.15s |