पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #68 | Claude Sonnet 5 medium | Anthropic | 7.7 | 8.2 | $0.922 | 2/3 | 2.98s |
| #78 | GPT-5.6 Terra high | OpenAI | 7.7 | 8.0 | $0.836 | 2/3 | 5.45s |
| #80 | GPT-5.2 Chat none | OpenAI | 7.7 | 7.9 | $0.594 | 2/3 | 4.10s |
| #82 | Qwen3.8 27B low | Qwen | 7.7 | 7.9 | ~$0.071 | 2/3 | 4.91s |
| #95 | Claude Opus 4.6 medium | Anthropic | 7.7 | 7.7 | $2.961 | 2/3 | 4.71s |
| #102 | Claude Opus 5 none | Anthropic | 7.7 | 7.5 | $1.550 | 2/3 | 3.66s |
| #111 | Grok Build 0.1 medium | X AI | 7.7 | 7.5 | $1.130 | 2/3 | 18.3s |
| #113 | Gemini 3.1 Flash Lite Preview medium | 7.7 | 7.4 | $0.117 | 2/3 | 5.30s | |
| #121 | Claude Sonnet 4.6 none | Anthropic | 7.7 | 7.3 | $0.661 | 2/3 | 2.53s |
| #126 | Qwen3.7 Plus none | Qwen | 7.7 | 7.3 | $0.106 | 2/3 | 1.71s |
| #128 | Claude Opus 4.8 none | Anthropic | 7.7 | 7.3 | $1.166 | 2/3 | 2.74s |
| #136 | Muse Glimmer 30B low | Meta | 7.7 | 7.1 | $0.143 | 2/3 | 5.06s |
| #141 | GPT-5.6 Sol none | OpenAI | 7.7 | 7.0 | $0.201 | 2/3 | 1.49s |
| #144 | GPT-5.5 none | OpenAI | 7.7 | 7.0 | $0.544 | 2/3 | 1.29s |
| #146 | Grok 4.20 medium | X AI | 7.7 | 7.0 | $0.805 | 2/3 | 6.22s |