नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.5-122B-A10B (medium) vs Grok 4.20 (medium)

average score लगभग बराबर है: 7.1 vs 7.1. Grok 4.20 (medium) की benchmark लागत कम है: $0.777 vs $1.046. Grok 4.20 (medium) तेज है: 29.47s vs 64.16s, pass rates 71.2% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#80
कुल आउटपुट टोकन
487,218
प्रतिक्रिया समय (औसत)
64.16s
कुल लागत
$1.046
रैंक
#83
कुल आउटपुट टोकन
259,340
प्रतिक्रिया समय (औसत)
29.47s
कुल लागत
$0.777
अनुशंसित मॉडल Grok 4.20 (medium)

It has the best score here (7.1), while responding about 2.2x faster than Qwen3.5-122B-A10B (medium).

विस्तृत तुलना

मेट्रिक Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium रिलीज़: 2026-02-24 Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर 7.1 7.1
रैंक #80 #83
विश्वसनीयता 10.0 10.0
संगति 8.5 8.5
सही परीक्षण
प्रति प्रयास पास दर 71.2% 63.6%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 8.509 9.709
कुल लागत $1.046 $0.777
इनपुट कीमत $0.260 / 1M $1.250 / 1M
आउटपुट कीमत $2.080 / 1M $2.500 / 1M
कुल इनपुट टोकन 124,771 102,791
आउटपुट टोकन 44,077 5,363
रीजनिंग टोकन 443,141 253,977
प्रतिक्रिया समय (औसत) 64.16s 29.47s
प्रतिक्रिया समय (अधिकतम) 519.30s 199.66s
प्रतिक्रिया समय (कुल) 1411.60s 648.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#80 Qwen3.5-122B-A10B

medium
लागत
$0.019
समय
48.7s
टोकन
6,034 tok

#83 xAI: Grok 4.20

medium
लागत
$0.041
समय
110.3s
टोकन
16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

त्वरित तुलना

तुलना जोड़ी बदलें