नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-35B-A3B vs xAI: Grok 4.20 Beta

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-03-12

मेट्रिक Qwen3.5-35B-A3B Qwen3.5-35B-A3B none प्रकाशन: 2026-02-24 Grok 4.20 Beta Grok 4.20 Beta none प्रकाशन: 2026-03-12
क्रमांक #48 #52
सरासरी स्कोअर 4.7 4.4
सुसंगतता 8.6 9.1
प्रति निकाल खर्च 0.237 2.214
एकूण खर्च $0.015 $0.089
बरोबर चाचण्या
प्रति प्रयत्न पास दर 50.0% 33.3%
अस्थिर चाचण्या 3 2
एकूण रन 48 48
आउटपुट टोकन्स 3,756 1,511
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 4.10s 1.22s
प्रतिसाद वेळ (कमाल) 47.43s 6.48s
प्रतिसाद वेळ (एकूण) 65.62s 19.53s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

सरासरी स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

सरासरी स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-35B-A3B 10.0 7.2 22.2% 1 1.76s 569 0
Grok 4.20 Beta 3.3 7.9 22.2% 1 562ms 245 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-35B-A3B 10.0 10.0 0.0% 0 47.43s 1,833 0
Grok 4.20 Beta 10.0 10.0 0.0% 0 6.48s 282 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-35B-A3B 9.9 10.0 100.0% 0 1.16s 243 0
Grok 4.20 Beta 9.9 10.0 100.0% 0 601ms 197 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-35B-A3B 7.0 10.0 66.7% 0 485ms 15 0
Grok 4.20 Beta 10.0 10.0 0.0% 0 611ms 160 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-35B-A3B 6.0 3.4 66.7% 1 1.19s 114 0
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-35B-A3B 5.0 10.0 50.0% 0 809ms 63 0
Grok 4.20 Beta 4.5 10.0 0.0% 0 687ms 60 0
Puzzle Solving स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-35B-A3B 1.7 7.4 22.2% 1 1.34s 655 0
Grok 4.20 Beta 4.0 7.2 55.6% 1 541ms 291 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 2.30s 264 0
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0

झटपट तुलना

तुलना जोडी बदला