पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #311 | Laguna Xs.2 medium | Poolside | 5.3 | 4.1 | $0.015 | 1/3 | 1.93s |
| #313 | MiMo-V2-Flash none | Xiaomi | 5.3 | 4.0 | $0.025 | 1/3 | 1.86s |
| #317 | Grok Build 0.1 none | X AI | 6.4 | 4.0 | $0.547 | 1/3 | 9.55s |
| #324 | Laguna Xs.2 none | Poolside | 5.3 | 3.8 | $0.004 | 1/3 | 650ms |
| #325 | gpt-oss-120b none | OpenAI | 6.0 | 3.7 | $0.033 | 1/3 | 8.21s |
| #8 | GPT-5.6 Sol low | OpenAI | 8.2 | 9.5 | $0.357 | 2/3 | 3.44s |
| #13 | GPT-5.6 Sol medium | OpenAI | 8.2 | 9.4 | $0.508 | 2/3 | 2.98s |
| #27 | Gemini 3.5 Flash medium | 7.7 | 9.0 | $0.665 | 2/3 | 2.38s | |
| #32 | GPT-5.3-Codex medium | OpenAI | 9.0 | 8.9 | $0.988 | 2/3 | 5.05s |
| #33 | Muse Spark 1.3 high | Meta | 8.7 | 8.9 | $1.653 | 2/3 | 38.4s |
| #34 | Pareto none | Unbiased | 8.2 | 8.9 | $1.172 | 2/3 | 18.2s |
| #43 | GLM 5.3 Flash max | Z.ai | 8.7 | 8.7 | $0.071 | 2/3 | 5.61s |
| #45 | Muse Spark 1.2 high | Meta | 8.2 | 8.7 | $1.771 | 2/3 | 10.1s |
| #46 | Muse Spark 1.2 medium | Meta | 8.7 | 8.6 | $1.339 | 2/3 | 9.45s |
| #47 | Muse Spark 1.1 medium | Meta | 7.9 | 8.6 | $1.420 | 2/3 | 42.5s |