पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #118 | Claude Sonnet 5 none | Anthropic | 6.0 | 6.3 | $0.548 | 1/3 | 3.22s |
| #85 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 5.9 | 6.9 | $0.467 | 1/3 | 3.20s |
| #23 | Grok 4.5 low | X AI | 10.0 | 8.4 | $0.935 | 3/3 | 3.20s |
| #28 | Gemini 2.5 Flash medium | 7.7 | 8.2 | $0.643 | 2/3 | 3.18s | |
| #146 | Nemotron 3 Super medium | NVIDIA | 3.0 | 5.7 | $0.055 | 0/3 | 3.15s |
| #83 | Gemini 3.5 Flash none | 10.0 | 7.0 | $1.079 | 3/3 | 3.13s | |
| #66 | KAT-Coder-Pro V2.5 low | Kwaipilot | 6.4 | 7.4 | $0.387 | 1/3 | 3.11s |
| #2 | Gemini 3.6 Flash high | 10.0 | 9.7 | $1.785 | 3/3 | 3.04s | |
| #97 | KAT-Coder-Pro V2.5 none | Kwaipilot | 8.2 | 6.7 | $0.476 | 2/3 | 3.03s |
| #45 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.077 | 3/3 | 3.01s |
| #58 | GPT-5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.571 | 3/3 | 2.99s |
| #7 | GPT-5.6 Sol medium | OpenAI | 8.2 | 9.4 | $1.316 | 2/3 | 2.98s |
| #26 | Claude Sonnet 5 medium | Anthropic | 7.7 | 8.3 | $0.922 | 2/3 | 2.98s |
| #129 | Inkling low | Thinkingmachines | 6.4 | 6.1 | $0.187 | 1/3 | 2.97s |
| #122 | Seed-2.0-Lite none | Bytedance Seed | 5.3 | 6.2 | $0.066 | 1/3 | 2.78s |