पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #110 | GPT-5.4 Mini medium | OpenAI | 7.8 | 7.5 | $0.786 | 2/3 | 4.37s |
| #189 | Ling-3.0-flash high | Inclusionai | 10.0 | 6.4 | $0.021 | 3/3 | 4.33s |
| #21 | Claude Opus 5 medium | Anthropic | 10.0 | 9.2 | $1.586 | 3/3 | 4.27s |
| #206 | Gemma 4 31B none | 6.5 | 6.1 | $0.016 | 1/3 | 4.23s | |
| #41 | Claude Opus 5 low | Anthropic | 10.0 | 8.7 | $1.121 | 3/3 | 4.23s |
| #160 | GLM 5.3 low | Z.ai | 10.0 | 6.8 | $0.257 | 3/3 | 4.20s |
| #240 | Owl Alpha none | Openrouter | 5.4 | 5.6 | $0.000 | 1/3 | 4.18s |
| #50 | Qwen3.8 Max low | Qwen | 9.9 | 8.6 | $0.702 | 3/3 | 4.11s |
| #80 | GPT-5.2 Chat none | OpenAI | 7.7 | 7.9 | $0.594 | 2/3 | 4.10s |
| #15 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $0.446 | 3/3 | 4.10s |
| #10 | Gemini 3 Flash Preview medium | 10.0 | 9.5 | $0.763 | 3/3 | 4.05s | |
| #116 | GPT-5.6 Luna medium | OpenAI | 7.8 | 7.4 | $0.072 | 2/3 | 4.04s |
| #254 | Kimi K2.5 none | Moonshot AI | 3.0 | 5.4 | $0.101 | 0/3 | 4.04s |
| #40 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 3/3 | 3.95s |
| #213 | Gemini 3 PRO Preview medium | 10.0 | 6.0 | $0.385 | 3/3 | 3.88s |