नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Qwen: Qwen3.5-9B vs xAI: Grok 4.20

सारांश

Qwen3.5-9B vs Grok 4.20 benchmark तुलना: Grok 4.20 average score में आगे है: 5.4 vs 4.6. Qwen3.5-9B की benchmark लागत कम है: $0.006 vs $0.057. Grok 4.20 तेज है: 1.11s vs 1.89s, pass rates 20.6% vs 33.3%.

अनुशंसित मॉडल: Qwen3.5-9B - It offers the best overall trade-off: a competitive score (4.6), lower cost than Grok 4.20, and balanced response time.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-10

मेट्रिक Qwen3.5-9B Qwen3.5-9B none रिलीज़: 2026-03-02 Grok 4.20 Grok 4.20 none रिलीज़: 2026-03-31
स्कोर 4.6 5.4
रैंक #155 #128
विश्वसनीयता 10.0 लागू नहीं
संगति 9.7 10.0
सही परीक्षण
प्रति प्रयास पास दर 20.6% 33.3%
अस्थिर टेस्ट 1 0
कुल रन 63 54
प्रति परिणाम लागत 0.123 1.570
कुल लागत $0.006 $0.057
इनपुट कीमत $0.100 / 1M $1.250 / 1M
आउटपुट कीमत $0.150 / 1M $2.500 / 1M
कुल इनपुट टोकन 48,041 41,313
आउटपुट टोकन 3,952 1,923
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 1.89s 1.11s
प्रतिक्रिया समय (अधिकतम) 6.03s 6.04s
प्रतिक्रिया समय (कुल) 39.68s 19.96s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#155 Qwen3.5-9B

none
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

#128 xAI: Grok 4.20

none
Cost
$0.004
Time
6.5s
Tokens
1,367 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.1 9.9 0.0% 0 1.71s 696 582 0
Grok 4.20 4.8 10.0 25.0% 0 501ms 1,986 267 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0
Grok 4.20 3.4 9.3 0.0% 0 1.22s 1,074 312 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.0 10.0 0.0% 0 5.91s 20,397 1,255 0
Grok 4.20 3.0 10.0 0.0% 0 6.04s 17,673 282 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 10.0 10.0 100.0% 0 847ms 7,788 249 0
Grok 4.20 10.0 10.0 100.0% 0 522ms 7,749 207 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.0 10.0 0.0% 0 464ms 789 24 0
Grok 4.20 3.0 10.0 0.0% 0 687ms 1,746 325 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 4.4 9.9 0.0% 0 552ms 522 99 0
Grok 4.20 4.8 10.0 0.0% 0 659ms 819 83 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 6.5 10.0 50.0% 0 514ms 711 75 0
Grok 4.20 6.3 10.0 50.0% 0 445ms 1,350 60 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.2 10.0 0.0% 0 621ms 714 347 0
Grok 4.20 5.3 10.0 33.3% 0 473ms 1,671 198 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 10.0 10.0 100.0% 0 1.27s 8,301 273 0
Grok 4.20 10.0 10.0 100.0% 0 4.63s 7,245 189 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.0 10.0 0.0% 0 2.32s 210 6 0
Grok 4.20 - - - - - - - - -

त्वरित तुलना

तुलना जोड़ी बदलें