पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #88 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 3/3 | 5.31s |
| #91 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.089 | 3/3 | 3.01s |
| #93 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 3/3 | 11.3s |
| #104 | GPT-5.6 Terra low | OpenAI | 10.0 | 7.5 | $0.420 | 3/3 | 4.46s |
| #106 | GPT 5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.533 | 3/3 | 2.99s |
| #107 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 3/3 | 32.5s |
| #109 | Mercury 2.5 Preview medium | Inception | 10.0 | 7.5 | $0.024 | 3/3 | 1.87s |
| #112 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 3/3 | 2.25s | |
| #114 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 3/3 | 1.13s |
| #118 | Qwen3.8 2.4T A95B high | Qwen | 10.0 | 7.4 | $2.357 | 3/3 | 65.5s |
| #119 | Grok 4.6 low | X AI | 10.0 | 7.4 | $0.449 | 3/3 | 8.16s |
| #120 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.185 | 3/3 | 5.77s | |
| #124 | GLM 5.3 Flash high | Z.ai | 10.0 | 7.3 | $0.034 | 3/3 | 3.04s |
| #135 | Qwen3.5-122B-A10B medium | Qwen | 10.0 | 7.1 | $1.047 | 3/3 | 17.9s |
| #153 | Gemini 3.5 Flash none | 10.0 | 6.9 | $1.093 | 3/3 | 3.13s |