पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #166 | KAT-Coder-Pro V2.5 none | Kwaipilot | 8.2 | 6.7 | $0.487 | 2/3 | 3.03s |
| #124 | GLM 5.3 Flash high | Z.ai | 10.0 | 7.3 | $0.034 | 3/3 | 3.04s |
| #123 | KAT-Coder-Pro V2.5 low | Kwaipilot | 6.4 | 7.3 | $0.400 | 1/3 | 3.11s |
| #153 | Gemini 3.5 Flash none | 10.0 | 6.9 | $1.093 | 3/3 | 3.13s | |
| #227 | Nemotron 3 Super medium | NVIDIA | 3.0 | 5.7 | $0.054 | 0/3 | 3.15s |
| #66 | Gemini 2.5 Flash medium | 7.7 | 8.2 | $0.644 | 2/3 | 3.18s | |
| #58 | Grok 4.5 low | X AI | 10.0 | 8.4 | $0.945 | 3/3 | 3.20s |
| #149 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 5.9 | 6.9 | $0.478 | 1/3 | 3.20s |
| #196 | Claude Sonnet 5 none | Anthropic | 6.0 | 6.1 | $0.548 | 1/3 | 3.22s |
| #11 | Gemini 3.5 Flash high | 10.0 | 9.4 | $2.011 | 3/3 | 3.23s | |
| #209 | Trinity Large Thinking low | Arcee AI | 6.3 | 6.0 | $0.625 | 1/3 | 3.28s |
| #165 | GLM 5.2 none | Z.ai | 7.7 | 6.7 | $0.221 | 2/3 | 3.31s |
| #1 | Gemini 3.6 Flash high | 10.0 | 9.9 | $0.699 | 3/3 | 3.36s | |
| #130 | KAT-Coder-Pro V2.5 high | Kwaipilot | 8.2 | 7.2 | $0.506 | 2/3 | 3.38s |
| #237 | Owl Alpha medium | Openrouter | 5.3 | 5.6 | $0.000 | 1/3 | 3.40s |