AI BENCHY श्रेणी
पहेली समाधान रैंकिंग
देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
| रैंक | मॉडल | कंपनी | पहेली समाधान स्कोर | स्कोर | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|
| #85 | Elephant none | Openrouter | 3.3 | 5.2 | 0/3 | 849ms |
| #60 | Gemma 4 26B A4B none | 5.7 | 6.2 | 1/3 | 739ms | |
| #90 | Qwen3.5-9B none | Qwen | 3.2 | 4.8 | 0/3 | 683ms |
| #83 | Mistral Small 4 none | Mistral | 3.1 | 5.2 | 0/3 | 589ms |
| #62 | Gemini 2.5 Flash none | 5.7 | 6.2 | 1/3 | 576ms | |
| #79 | Grok 4.20 Beta none | X AI | 5.9 | 5.3 | 1/3 | 541ms |
| #91 | Mercury 2 none | Inception | 3.1 | 4.8 | 0/3 | 533ms |
| #82 | Grok 4.20 none | X AI | 5.3 | 5.2 | 1/3 | 487ms |