पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #38 | Muse Spark 1.3 medium | Meta | 10.0 | 8.8 | $1.469 | 3/3 | 25.0s |
| #39 | Gemini 3.5 Flash Lite high | 10.0 | 8.8 | $0.540 | 3/3 | 2.09s | |
| #40 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 3/3 | 3.95s |
| #41 | Claude Opus 5 low | Anthropic | 10.0 | 8.7 | $1.121 | 3/3 | 4.23s |
| #42 | Gemini 3.6 Flash low | 10.0 | 8.7 | $0.251 | 3/3 | 2.38s | |
| #44 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.476 | 3/3 | 2.43s |
| #49 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.6 | $1.132 | 3/3 | 24.3s |
| #55 | Grok 4.5 medium | X AI | 10.0 | 8.5 | $2.042 | 3/3 | 7.75s |
| #58 | Grok 4.5 low | X AI | 10.0 | 8.4 | $0.945 | 3/3 | 3.20s |
| #69 | Qwen3.8 2.4T A95B low | Qwen | 10.0 | 8.1 | $2.672 | 3/3 | 43.4s |
| #77 | Inkling medium | Thinkingmachines | 10.0 | 8.0 | $0.383 | 3/3 | 5.18s |
| #79 | Kimi K3 max | Moonshot AI | 10.0 | 7.9 | $2.528 | 3/3 | 7.36s |
| #83 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 3/3 | 16.4s |
| #84 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 3/3 | 6.34s |
| #88 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 3/3 | 5.31s |