नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.5-122B-A10B (medium) vs Grok 4.20 (medium)

average score जवळपास समान आहे: 7.1 vs 7.1. Grok 4.20 (medium) चा benchmark खर्च कमी आहे: $0.777 vs $1.046. Grok 4.20 (medium) वेगवान आहे: 29.47s vs 64.16s, pass rates 71.2% vs 63.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#80
एकूण आउटपुट टोकन्स
487,218
प्रतिसाद वेळ (सरासरी)
64.16s
एकूण खर्च
$1.046
क्रमांक
#83
एकूण आउटपुट टोकन्स
259,340
प्रतिसाद वेळ (सरासरी)
29.47s
एकूण खर्च
$0.777
शिफारस केलेले मॉडेल Grok 4.20 (medium)

It has the best score here (7.1), while responding about 2.2x faster than Qwen3.5-122B-A10B (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium प्रकाशन: 2026-02-24 Grok 4.20 Grok 4.20 medium प्रकाशन: 2026-03-31
स्कोअर 7.1 7.1
क्रमांक #80 #83
विश्वसनीयता 10.0 10.0
सुसंगतता 8.5 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 63.6%
अस्थिर चाचण्या 4 4
एकूण रन 66 66
प्रति निकाल खर्च 8.509 9.709
एकूण खर्च $1.046 $0.777
इनपुट किंमत $0.260 / 1M $1.250 / 1M
आउटपुट किंमत $2.080 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 124,771 102,791
आउटपुट टोकन्स 44,077 5,363
रिझनिंग टोकन्स 443,141 253,977
प्रतिसाद वेळ (सरासरी) 64.16s 29.47s
प्रतिसाद वेळ (कमाल) 519.30s 199.66s
प्रतिसाद वेळ (एकूण) 1411.60s 648.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#80 Qwen3.5-122B-A10B

medium
खर्च
$0.019
वेळ
48.7s
टोकन्स
6,034 tok

#83 xAI: Grok 4.20

medium
खर्च
$0.041
वेळ
110.3s
टोकन्स
16,336 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

झटपट तुलना

तुलना जोडी बदला