नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-122B-A10B vs xAI: Grok Build 0.1

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-05-21

मेट्रिक Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium प्रकाशन: 2026-02-24 Grok Build 0.1 Grok Build 0.1 medium प्रकाशन: 2026-05-21
स्कोअर 7.9 7.8
क्रमांक #36 #41
विश्वसनीयता 10.0 10.0
सुसंगतता 8.7 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 75.4% 71.9%
अस्थिर चाचण्या 3 3
एकूण रन 57 57
प्रति निकाल खर्च 4.315 4.064
एकूण खर्च $0.561 $0.488
???? ??? $0.260 / 1M $1.000 / 1M
????? ??? $2.080 / 1M $2.000 / 1M
आउटपुट टोकन्स 18,457 1,947
रिझनिंग टोकन्स 177,734 223,372
प्रतिसाद वेळ (सरासरी) 32.51s 22.28s
प्रतिसाद वेळ (कमाल) 119.29s 88.28s
प्रतिसाद वेळ (एकूण) 617.70s 423.30s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 9.75s 269 16,835
Grok Build 0.1 10.0 10.0 100.0% 0 5.46s 195 9,825
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 4.7 1.6 66.7% 1 70.98s 322 10,694
Grok Build 0.1 7.3 3.7 66.7% 1 30.98s 354 17,734
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 107.79s 483 11,337
Grok Build 0.1 10.0 10.0 100.0% 0 30.81s 231 18,779
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 23.41s 270 16,558
Grok Build 0.1 10.0 10.0 100.0% 0 7.76s 180 10,343
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 2.9 7.2 11.1% 1 63.40s 15,537 64,889
Grok Build 0.1 5.3 10.0 33.3% 0 77.75s 501 111,807
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 3.4 2.2 33.3% 1 34.11s 66 7,592
Grok Build 0.1 3.8 2.5 33.3% 1 10.14s 78 5,386
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 9.88s 77 7,372
Grok Build 0.1 9.8 10.0 100.0% 0 9.62s 57 12,436
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 17.18s 289 26,165
Grok Build 0.1 6.2 7.5 55.6% 1 8.67s 161 15,476
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 4.60s 322 1,226
Grok Build 0.1 10.0 10.0 100.0% 0 9.40s 180 5,319
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 52.87s 822 15,066
Grok Build 0.1 3.0 10.0 0.0% 0 26.07s 10 16,267

झटपट तुलना

तुलना जोडी बदला