नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5-Flash vs xAI: Grok Build 0.1

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-05-28

मेट्रिक Qwen3.5-Flash Qwen3.5-Flash medium प्रकाशन: 2026-02-24 Grok Build 0.1 Grok Build 0.1 medium प्रकाशन: 2026-05-21
स्कोअर 7.6 7.7
क्रमांक #48 #43
विश्वसनीयता 10.0 10.0
सुसंगतता 8.0 9.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 75.0% 65.0%
अस्थिर चाचण्या 5 0
एकूण रन 60 60
प्रति निकाल खर्च 0.821 5.606
एकूण खर्च $0.074 $0.729
इनपुट किंमत $0.065 / 1M $1.000 / 1M
आउटपुट किंमत $0.260 / 1M $2.000 / 1M
आउटपुट टोकन्स 2,074 2,258
रिझनिंग टोकन्स 272,063 341,381
प्रतिसाद वेळ (सरासरी) 63.04s 42.39s
प्रतिसाद वेळ (कमाल) 234.29s 252.69s
प्रतिसाद वेळ (एकूण) 1197.71s 847.76s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 10.0 10.0 100.0% 0 59.11s 383 32,992
Grok Build 0.1 8.3 10.0 75.0% 0 7.43s 220 12,162
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 4.1 5.8 33.3% 1 54.23s 288 67,546
Grok Build 0.1 7.0 9.5 50.0% 0 62.62s 614 64,815
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 483 8,270
Grok Build 0.1 10.0 10.0 100.0% 0 32.81s 231 16,917
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 7.3 5.9 83.3% 1 56.99s 235 16,237
Grok Build 0.1 10.0 10.0 100.0% 0 10.72s 180 8,876
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 5.3 7.2 44.4% 1 146.50s 58 43,615
Grok Build 0.1 5.3 10.0 33.3% 0 158.00s 492 175,294
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 6.1 3.1 66.7% 1 40.05s 99 38,486
Grok Build 0.1 4.4 9.9 0.0% 0 18.41s 76 6,345
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 98 14,139
Grok Build 0.1 9.8 10.0 100.0% 0 12.36s 57 9,599
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 8.2 7.2 88.9% 1 27.61s 89 12,457
Grok Build 0.1 7.7 10.0 66.7% 0 18.26s 195 20,841
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 309 1,284
Grok Build 0.1 10.0 10.0 100.0% 0 13.12s 180 4,969
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-Flash 3.0 10.0 0.0% 0 48.98s 32 37,037
Grok Build 0.1 3.0 10.0 0.0% 0 53.51s 13 21,563

झटपट तुलना

तुलना जोडी बदला