नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Qwen: Qwen3.5-9B vs xAI: Grok 4.1 Fast

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-12

मेट्रिक Qwen3.5-9B Qwen3.5-9B medium रिलीज़: 2026-03-02 Grok 4.1 Fast Grok 4.1 Fast none रिलीज़: 2025-11-19
रैंक #66 #63
औसत स्कोर 2.6 2.9
संगति 7.4 8.9
प्रति परिणाम लागत 0.779 0.247
कुल लागत $0.024 $0.008
सही परीक्षण
प्रति प्रयास पास दर 35.4% 25.0%
अस्थिर टेस्ट 5 2
कुल रन 48 48
आउटपुट टोकन 17,930 1,148
रीजनिंग टोकन 139,706 0
प्रतिक्रिया समय (औसत) 71.44s 1.90s
प्रतिक्रिया समय (अधिकतम) 226.38s 5.51s
प्रतिक्रिया समय (कुल) 928.77s 17.14s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

औसत स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

औसत स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 4.0 7.2 55.6% 1 31.54s 2,410 10,913
Grok 4.1 Fast 1.3 10.0 0.0% 0 1.73s 229 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 10.0 10.0 0.0% 0 0ms 0 0
Grok 4.1 Fast 10.0 10.0 0.0% 0 3.33s 105 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 5.0 5.6 33.3% 1 87.31s 1,383 32,113
Grok 4.1 Fast 9.9 10.0 100.0% 0 943ms 180 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 10.0 7.2 22.2% 1 137.75s 11,549 48,475
Grok 4.1 Fast 4.0 7.2 55.6% 1 1.06s 15 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 10.0 1.6 33.3% 1 226.38s 0 30,695
Grok 4.1 Fast 3.0 9.9 0.0% 0 1.08s 112 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 5.5 5.8 66.7% 1 17.15s 599 4,517
Grok 4.1 Fast 10.0 10.0 0.0% 0 923ms 56 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 10.0 10.0 0.0% 0 33.38s 1,545 11,844
Grok 4.1 Fast 1.3 10.0 0.0% 0 1.28s 243 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 444 1,149
Grok 4.1 Fast 10.0 1.6 33.3% 1 5.51s 208 0

त्वरित तुलना

तुलना जोड़ी बदलें