AI BENCHY
Your ad here

AI BENCHY श्रेणी

पहेली समाधान रैंकिंग

देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.

दिखाए गए मॉडल

8

औसत पहेली समाधान स्कोर

6.4

सर्वश्रेष्ठ मॉडल

Grok 4.20 5.3
रैंक मॉडल कंपनी पहेली समाधान स्कोर स्कोर सही परीक्षण प्रतिक्रिया समय (औसत)
#43 Qwen3.5-35B-A3B medium Qwen 6.4 7.4 1/3 31.6s
#97 Qwen3.5-9B medium Qwen 3.1 4.4 0/3 33.4s
#8 Qwen3.5 Plus 2026-02-15 medium Qwen 10.0 8.5 3/3 34.6s
#27 DeepSeek V3.2 medium DeepSeek 8.2 8.0 2/3 36.9s
#46 Kimi K2.5 medium Moonshot AI 5.3 7.0 1/3 45.4s
#11 Gemini 3.1 Flash Lite Preview high Google 7.7 8.4 2/3 46.3s
#32 Qwen3.5-Flash medium Qwen 6.4 7.8 1/3 56.7s
#10 Qwen3.5-27B medium Qwen 8.2 8.4 2/3 64.6s

पहेली समाधान स्कोर के अनुसार शीर्ष मॉडल

पहेली समाधान स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत) के अनुसार शीर्ष मॉडल