पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #136 | Muse Glimmer 30B low | Meta | 7.7 | 7.1 | $0.143 | 2/3 | 5.06s |
| #138 | Solar Pro 4 high | Upstage | 8.7 | 7.1 | $0.138 | 2/3 | 55.2s |
| #139 | Mercury 2.5 high | Inception | 8.7 | 7.1 | $0.031 | 2/3 | 1.39s |
| #141 | GPT-5.6 Sol none | OpenAI | 7.7 | 7.0 | $0.201 | 2/3 | 1.49s |
| #143 | GLM 5.1 medium | Z.ai | 8.2 | 7.0 | $0.727 | 2/3 | 31.6s |
| #144 | GPT-5.5 none | OpenAI | 7.7 | 7.0 | $0.544 | 2/3 | 1.29s |
| #146 | Grok 4.20 medium | X AI | 7.7 | 7.0 | $0.805 | 2/3 | 6.22s |
| #147 | Seed-2.0-Mini medium | Bytedance Seed | 8.2 | 7.0 | $0.116 | 2/3 | 31.8s |
| #150 | Claude Fable 5.1 low | Anthropic | 7.7 | 6.9 | $2.565 | 2/3 | 4.78s |
| #152 | Seed-2.0-Code high | Bytedance Seed | 7.8 | 6.9 | $1.273 | 2/3 | 15.9s |
| #154 | Qwen3.6 Flash medium | Qwen | 8.2 | 6.8 | $0.741 | 2/3 | 6.29s |
| #156 | Seed-2.0-Code medium | Bytedance Seed | 8.2 | 6.8 | $1.153 | 2/3 | 34.3s |
| #157 | Solar Pro 4 low | Upstage | 9.0 | 6.8 | $0.130 | 2/3 | 42.1s |
| #158 | Solar Pro 4 medium | Upstage | 9.0 | 6.8 | $0.140 | 2/3 | 45.8s |
| #163 | Gemini 3 Flash Preview none | 7.7 | 6.8 | $0.085 | 2/3 | 1.05s |