पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #48 | Claude Fable 5 medium | Anthropic | 7.7 | 8.6 | $3.004 | 2/3 | 5.18s |
| #51 | GPT-5.4 medium | OpenAI | 8.2 | 8.5 | $1.560 | 2/3 | 9.14s |
| #52 | DeepSeek V4.1 Flash low | DeepSeek | 8.2 | 8.5 | $0.448 | 2/3 | 9.39s |
| #54 | DeepSeek V4.1 Flash medium | DeepSeek | 8.7 | 8.5 | $0.544 | 2/3 | 8.01s |
| #56 | Muse Spark 1.2 low | Meta | 8.7 | 8.4 | $0.655 | 2/3 | 5.17s |
| #57 | Grok 4.6 medium | X AI | 8.7 | 8.4 | $1.713 | 2/3 | 16.3s |
| #59 | GPT-5.2 medium | OpenAI | 7.5 | 8.4 | $1.182 | 2/3 | 5.80s |
| #60 | Qwen3.8 27B high | Qwen | 7.6 | 8.4 | ~$0.287 | 2/3 | 199.9s |
| #64 | Muse Spark 1.1 low | Meta | 8.3 | 8.3 | $0.673 | 2/3 | 6.60s |
| #65 | Claude Fable 5.1 medium | Anthropic | 7.6 | 8.3 | $2.909 | 2/3 | 5.70s |
| #66 | Gemini 2.5 Flash medium | 7.7 | 8.2 | $0.644 | 2/3 | 3.18s | |
| #67 | Muse Spark 1.3 low | Meta | 8.2 | 8.2 | $0.689 | 2/3 | 11.3s |
| #68 | Claude Sonnet 5 medium | Anthropic | 7.7 | 8.2 | $0.922 | 2/3 | 2.98s |
| #71 | Muse Glimmer 30B xhigh | Meta | 7.8 | 8.1 | $0.471 | 2/3 | 199.7s |
| #73 | Muse Spark 1.1 high | Meta | 7.8 | 8.0 | $2.253 | 2/3 | 70.0s |