पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #18 | Gemini 3.1 Pro Preview medium | 10.0 | 9.2 | $1.352 | 3/3 | 6.90s | |
| #19 | Gemini 3.7 Flash low | 10.0 | 9.2 | $0.207 | 3/3 | 1.92s | |
| #20 | Claude Opus 5 high | Anthropic | 10.0 | 9.2 | $3.070 | 3/3 | 4.66s |
| #21 | Claude Opus 5 medium | Anthropic | 10.0 | 9.2 | $1.586 | 3/3 | 4.27s |
| #22 | Gemini 3.8 Flash medium | 10.0 | 9.1 | $0.653 | 3/3 | 2.73s | |
| #23 | Qwen3.8 Max (0902) low | Qwen | 10.0 | 9.1 | $0.664 | 3/3 | 4.49s |
| #24 | Seed 2.1 Turbo low | Bytedance Seed | 10.0 | 9.1 | $1.546 | 3/3 | 23.5s |
| #25 | Qwen3.7 Max medium | Qwen | 10.0 | 9.1 | $1.157 | 3/3 | 8.84s |
| #26 | Claude Fable 5.1 high | Anthropic | 10.0 | 9.0 | $3.364 | 3/3 | 6.11s |
| #28 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $4.163 | 3/3 | 6.76s |
| #29 | Qwen3.8 Max medium | Qwen | 10.0 | 9.0 | $0.771 | 3/3 | 4.93s |
| #30 | Grok 4.5 high | X AI | 10.0 | 9.0 | $2.252 | 3/3 | 7.88s |
| #31 | Qwen3.8 Max (0902) high | Qwen | 10.0 | 8.9 | $2.736 | 3/3 | 134.1s |
| #35 | Seed 2.1 Turbo high | Bytedance Seed | 10.0 | 8.9 | $1.797 | 3/3 | 27.3s |
| #36 | Gemini 3.5 Flash low | 10.0 | 8.8 | $0.449 | 3/3 | 2.35s |