पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #83 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 3/3 | 16.4s |
| #84 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 3/3 | 6.34s |
| #88 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 3/3 | 5.31s |
| #91 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.089 | 3/3 | 3.01s |
| #93 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 3/3 | 11.3s |
| #94 | Seed-2.0-Code low | Bytedance Seed | 9.9 | 7.7 | $0.767 | 3/3 | 12.5s |
| #104 | GPT-5.6 Terra low | OpenAI | 10.0 | 7.5 | $0.420 | 3/3 | 4.46s |
| #106 | GPT 5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.533 | 3/3 | 2.99s |
| #107 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 3/3 | 32.5s |
| #109 | Mercury 2.5 Preview medium | Inception | 10.0 | 7.5 | $0.024 | 3/3 | 1.87s |
| #112 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 3/3 | 2.25s | |
| #114 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 3/3 | 1.13s |
| #118 | Qwen3.8 2.4T A95B high | Qwen | 10.0 | 7.4 | $2.357 | 3/3 | 65.5s |
| #119 | Grok 4.6 low | X AI | 10.0 | 7.4 | $0.449 | 3/3 | 8.16s |
| #120 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.185 | 3/3 | 5.77s |