पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #280 | GPT-4o-mini none | OpenAI | 3.5 | 5.0 | $0.010 | 0/3 | 1.21s |
| #283 | Ling-2.6-flash none | Inclusionai | 2.9 | 4.9 | $0.002 | 0/3 | 6.51s |
| #285 | Hy4 preview none | Tencent | 4.6 | 4.8 | $0.041 | 0/3 | 24.1s |
| #287 | Nemotron 3.5 Lightning low | NVIDIA | 3.6 | 4.8 | $0.140 | 0/3 | 6.21s |
| #289 | Trinity Large Thinking high | Arcee AI | 4.7 | 4.8 | $0.592 | 0/3 | 3.84s |
| #291 | KAT-Coder-Air V2.5 none | Kwaipilot | 2.9 | 4.8 | $0.070 | 0/3 | 1.84s |
| #293 | Trinity Large Preview none | Arcee AI | 3.6 | 4.8 | $0.008 | 0/3 | 1.97s |
| #297 | Cobuddy medium | Baidu | 3.6 | 4.7 | $0.000 | 0/3 | 12.8s |
| #298 | Mercury 2 none | Inception | 3.1 | 4.7 | $0.030 | 0/3 | 535ms |
| #299 | Granite 4.2 8B high | IBM Granite | 2.9 | 4.6 | $0.135 | 0/3 | 202.7s |
| #300 | Qwen3 Coder Next medium | Qwen | 3.0 | 4.6 | $0.034 | 0/3 | 1.25s |
| #302 | Laguna S 2.1 none | Poolside | 3.1 | 4.5 | $0.022 | 0/3 | 828ms |
| #304 | Laguna M.1 none | Poolside | 3.0 | 4.4 | $0.009 | 0/3 | 891ms |
| #305 | Elephant Alpha none | Openrouter | 4.2 | 4.3 | $0.000 | 0/3 | 807ms |
| #306 | GLM 4.7 Flash medium | Z.ai | 2.9 | 4.3 | $0.168 | 0/3 | 12.9s |