पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #151 | Qwen3.7 Flash medium | Qwen | 7.1 | 6.9 | $0.065 | 1/3 | 8.30s |
| #155 | Step 3.7 Flash high | Stepfun | 5.3 | 6.8 | $1.229 | 1/3 | 10.2s |
| #161 | MiMo-V2.5-Pro medium | Xiaomi | 6.7 | 6.8 | $0.221 | 1/3 | 5.31s |
| #173 | Qwen3.5-27B none | Qwen | 6.7 | 6.6 | $0.058 | 1/3 | 1.38s |
| #175 | Inkling Small medium | Thinkingmachines | 5.8 | 6.6 | $0.113 | 1/3 | 5.24s |
| #181 | Laguna XS 2.1 medium | Poolside | 5.3 | 6.5 | $0.068 | 1/3 | 3.43s |
| #185 | Dots 3 Note Preview low | Dots Studio | 5.3 | 6.4 | $0.000 | 1/3 | 8.52s |
| #186 | Dots 3 Note Preview high | Dots Studio | 5.5 | 6.4 | $0.000 | 1/3 | 12.7s |
| #190 | Ring-2.6-1T medium | Inclusionai | 5.9 | 6.4 | $0.102 | 1/3 | 20.7s |
| #191 | Mimo V2 PRO medium | Xiaomi | 6.4 | 6.3 | $0.333 | 1/3 | 5.08s |
| #193 | Seed-2.0-Lite none | Bytedance Seed | 5.3 | 6.2 | $0.066 | 1/3 | 2.78s |
| #196 | Claude Sonnet 5 none | Anthropic | 6.0 | 6.1 | $0.548 | 1/3 | 3.22s |
| #197 | Gemini 3.1 Flash Lite minimal | 6.0 | 6.1 | $0.047 | 1/3 | 2.15s | |
| #199 | gpt-oss-120b medium | OpenAI | 5.3 | 6.1 | $0.070 | 1/3 | 21.7s |
| #201 | Gemini 3.1 Flash Lite none | 6.3 | 6.1 | $0.046 | 1/3 | 720ms |