पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #188 | MiMo-V2.5 medium | Xiaomi | 8.2 | 6.4 | $0.104 | 2/3 | 20.3s |
| #226 | North Mini Code medium | Cohere | 3.3 | 5.7 | $0.000 | 0/3 | 19.7s |
| #111 | Grok Build 0.1 medium | X AI | 7.7 | 7.5 | $1.130 | 2/3 | 18.3s |
| #34 | Pareto none | Unbiased | 8.2 | 8.9 | $1.172 | 2/3 | 18.2s |
| #135 | Qwen3.5-122B-A10B medium | Qwen | 10.0 | 7.1 | $1.047 | 3/3 | 17.9s |
| #132 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 8.2 | 7.2 | $0.323 | 2/3 | 17.7s |
| #83 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 3/3 | 16.4s |
| #57 | Grok 4.6 medium | X AI | 8.7 | 8.4 | $1.713 | 2/3 | 16.3s |
| #152 | Seed-2.0-Code high | Bytedance Seed | 7.8 | 6.9 | $1.273 | 2/3 | 15.9s |
| #17 | Grok 4.6 high | X AI | 10.0 | 9.3 | $1.908 | 3/3 | 15.6s |
| #70 | GPT-5 Mini medium | OpenAI | 5.6 | 8.1 | $0.241 | 1/3 | 15.2s |
| #99 | GPT-5.6 Luna high | OpenAI | 7.6 | 7.6 | $0.179 | 2/3 | 14.6s |
| #62 | Inkling Small high | Thinkingmachines | 4.8 | 8.4 | $0.398 | 0/3 | 14.4s |
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 6.4 | 8.5 | $0.574 | 1/3 | 14.3s |
| #86 | GLM 5.2 medium | Z.ai | 8.2 | 7.8 | $0.324 | 2/3 | 13.1s |