पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #163 | Gemini 3 Flash Preview none | 7.7 | 6.8 | $0.085 | 2/3 | 1.05s | |
| #165 | GLM 5.2 none | Z.ai | 7.7 | 6.7 | $0.221 | 2/3 | 3.31s |
| #166 | KAT-Coder-Pro V2.5 none | Kwaipilot | 8.2 | 6.7 | $0.487 | 2/3 | 3.03s |
| #169 | GLM 5V Turbo medium | Z.ai | 7.7 | 6.7 | $0.457 | 2/3 | 10.2s |
| #172 | Gemini 3.5 Flash Lite low | 7.6 | 6.6 | $0.138 | 2/3 | 1.19s | |
| #177 | Qwen3.6 35B A3B medium | Qwen | 8.0 | 6.6 | $0.672 | 2/3 | 5.95s |
| #179 | Qwen3.5 Plus 2026-02-15 none | Qwen | 7.7 | 6.6 | $0.073 | 2/3 | 2.71s |
| #180 | Qwen3.6 27B medium | Qwen | 7.7 | 6.5 | $0.577 | 2/3 | 61.1s |
| #182 | Hy3 preview medium | Tencent | 7.7 | 6.5 | $0.049 | 2/3 | 11.1s |
| #188 | MiMo-V2.5 medium | Xiaomi | 8.2 | 6.4 | $0.104 | 2/3 | 20.3s |
| #192 | MiMo-V2-Flash medium | Xiaomi | 7.7 | 6.3 | $0.043 | 2/3 | 3.87s |
| #195 | GPT-5.6 Luna low | OpenAI | 7.6 | 6.2 | $0.051 | 2/3 | 3.59s |
| #198 | Qwen3.5-35B-A3B medium | Qwen | 8.2 | 6.1 | $1.172 | 2/3 | 33.1s |
| #202 | Qwen3.5-Flash medium | Qwen | 8.2 | 6.1 | $0.142 | 2/3 | 27.6s |
| #210 | Gemini 2.5 Flash none | 7.7 | 6.0 | $0.017 | 2/3 | 604ms |