पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #86 | GLM 5.2 medium | Z.ai | 8.2 | 7.8 | $0.324 | 2/3 | 13.1s |
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 6.4 | 8.5 | $0.574 | 1/3 | 14.3s |
| #62 | Inkling Small high | Thinkingmachines | 4.8 | 8.4 | $0.398 | 0/3 | 14.4s |
| #99 | GPT-5.6 Luna high | OpenAI | 7.6 | 7.6 | $0.179 | 2/3 | 14.6s |
| #70 | GPT-5 Mini medium | OpenAI | 5.6 | 8.1 | $0.241 | 1/3 | 15.2s |
| #17 | Grok 4.6 high | X AI | 10.0 | 9.3 | $1.908 | 3/3 | 15.6s |
| #152 | Seed-2.0-Code high | Bytedance Seed | 7.8 | 6.9 | $1.273 | 2/3 | 15.9s |
| #57 | Grok 4.6 medium | X AI | 8.7 | 8.4 | $1.713 | 2/3 | 16.3s |
| #83 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 3/3 | 16.4s |
| #132 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 8.2 | 7.2 | $0.323 | 2/3 | 17.7s |
| #135 | Qwen3.5-122B-A10B medium | Qwen | 10.0 | 7.1 | $1.047 | 3/3 | 17.9s |
| #34 | Pareto none | Unbiased | 8.2 | 8.9 | $1.172 | 2/3 | 18.2s |
| #111 | Grok Build 0.1 medium | X AI | 7.7 | 7.5 | $1.130 | 2/3 | 18.3s |
| #226 | North Mini Code medium | Cohere | 3.3 | 5.7 | $0.000 | 0/3 | 19.7s |
| #188 | MiMo-V2.5 medium | Xiaomi | 8.2 | 6.4 | $0.104 | 2/3 | 20.3s |