पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #309 | Hunter Alpha none | OpenRouter | 5.8 | 4.2 | $0.000 | 1/3 | 3.71s |
| #310 | Grok 4.20 none | X AI | 5.3 | 4.1 | $0.057 | 1/3 | 473ms |
| #311 | Laguna Xs.2 medium | Poolside | 5.3 | 4.1 | $0.015 | 1/3 | 1.93s |
| #313 | MiMo-V2-Flash none | Xiaomi | 5.3 | 4.0 | $0.025 | 1/3 | 1.86s |
| #317 | Grok Build 0.1 none | X AI | 6.4 | 4.0 | $0.547 | 1/3 | 9.55s |
| #324 | Laguna Xs.2 none | Poolside | 5.3 | 3.8 | $0.004 | 1/3 | 650ms |
| #325 | gpt-oss-120b none | OpenAI | 6.0 | 3.7 | $0.033 | 1/3 | 8.21s |
| #62 | Inkling Small high | Thinkingmachines | 4.8 | 8.4 | $0.398 | 0/3 | 14.4s |
| #103 | GPT-5.4 Nano medium | OpenAI | 4.1 | 7.5 | $0.142 | 0/3 | 3.79s |
| #167 | LongCat 2.0 low | Meituan | 3.1 | 6.7 | $0.412 | 0/3 | 8.15s |
| #170 | LongCat 2.0 high | Meituan | 3.1 | 6.7 | $0.492 | 0/3 | 9.18s |
| #187 | LongCat 2.0 none | Meituan | 4.0 | 6.4 | $0.044 | 0/3 | 2.74s |
| #200 | Qwen3.7 Flash none | Qwen | 3.7 | 6.1 | $0.019 | 0/3 | 1.39s |
| #204 | Trinity Large Thinking medium | Arcee AI | 5.2 | 6.1 | $0.756 | 0/3 | 2.90s |
| #205 | Qwen3.6 Flash none | Qwen | 3.5 | 6.1 | $0.062 | 0/3 | 1.21s |