नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3 Coder Next vs xAI: Grok 4.20

सारांश

Qwen3 Coder Next vs Grok 4.20 benchmark तुलना: Qwen3 Coder Next average score मध्ये पुढे आहे: 4.7 vs 4.4. Qwen3 Coder Next चा benchmark खर्च कमी आहे: $0.008 vs $0.057. Grok 4.20 वेगवान आहे: 1.11s vs 8.58s, pass rates 28.6% vs 28.6%.

शिफारस केलेले मॉडेल: Qwen3 Coder Next - It has the best score here (4.7), while costing about 7.2x less than Grok 4.20.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-02

मेट्रिक Qwen3 Coder Next Qwen3 Coder Next medium प्रकाशन: 2026-02-03 Grok 4.20 Grok 4.20 none प्रकाशन: 2026-03-31
स्कोअर 4.7 4.4
क्रमांक #153 #160
विश्वसनीयता 10.0 लागू नाही
सुसंगतता 8.9 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 28.6% 28.6%
अस्थिर चाचण्या 3 0
एकूण रन 63 54
प्रति निकाल खर्च 0.201 1.570
एकूण खर्च $0.008 $0.057
इनपुट किंमत $0.110 / 1M $1.250 / 1M
आउटपुट किंमत $0.800 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 47,250 41,313
आउटपुट टोकन्स 3,319 1,923
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 8.58s 1.11s
प्रतिसाद वेळ (कमाल) 81.80s 6.04s
प्रतिसाद वेळ (एकूण) 128.68s 19.96s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#153 Qwen3 Coder Next

medium
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

#160 xAI: Grok 4.20

none
खर्च
$0.004
वेळ
6.5s
टोकन्स
1,367 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3 Coder Next 3.5 8.1 16.7% 1 8.64s 645 1,252 0
Grok 4.20 4.8 10.0 25.0% 0 501ms 1,986 267 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3 Coder Next 3.7 7.2 22.2% 1 924ms 7,185 336 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3 Coder Next 3.0 10.0 0.0% 0 4.28s 20,469 317 0
Grok 4.20 3.0 10.0 0.0% 0 6.04s 17,673 282 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3 Coder Next 6.5 10.0 50.0% 0 81.80s 7,758 246 0
Grok 4.20 10.0 10.0 100.0% 0 522ms 7,749 207 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3 Coder Next 5.3 10.0 33.3% 0 638ms 753 25 0
Grok 4.20 3.0 10.0 0.0% 0 687ms 1,746 325 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3 Coder Next 6.3 3.4 66.7% 1 1.39s 498 142 0
Grok 4.20 4.8 10.0 0.0% 0 659ms 819 83 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3 Coder Next 6.3 10.0 50.0% 0 7.49s 684 63 0
Grok 4.20 6.3 10.0 50.0% 0 445ms 1,350 60 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3 Coder Next 3.0 10.0 0.0% 0 1.25s 678 671 0
Grok 4.20 5.3 10.0 33.3% 0 473ms 1,671 198 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3 Coder Next 10.0 10.0 100.0% 0 2.64s 8,364 255 0
Grok 4.20 10.0 10.0 100.0% 0 4.63s 7,245 189 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3 Coder Next 3.0 10.0 0.0% 0 399ms 216 12 0
Grok 4.20 0.0 0.0 0.0% 0 0ms 0 0 0

झटपट तुलना

तुलना जोडी बदला