पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #169 | Gemini 3.1 Flash Lite Preview high | 7.7 | 5.3 | $2.310 | 2/3 | 46.7s | |
| #47 | Claude Opus 4.6 medium | Anthropic | 7.7 | 7.7 | $3.059 | 2/3 | 4.71s |
| #37 | Kimi K3 max | Moonshot AI | 10.0 | 8.0 | $3.112 | 3/3 | 7.36s |
| #20 | Claude Fable 5 medium | Anthropic | 7.7 | 8.6 | $3.478 | 2/3 | 5.18s |
| #13 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $4.137 | 3/3 | 6.76s |
| #187 | Grok 4.20 Multi Agent Beta medium | X AI | 6.7 | 4.8 | $5.599 | 1/3 | 5.19s |