نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-Flash vs xAI: Grok 4.20 Beta

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-03-12

میٹرک Qwen3.5-Flash Qwen3.5-Flash medium اجرا: 2026-02-24 Grok 4.20 Beta Grok 4.20 Beta medium اجرا: 2026-03-12
درجہ #26 #24
اوسط اسکور 6.9 7.0
تسلسل 7.5 9.0
فی نتیجہ لاگت 0.720 5.989
کل لاگت $0.072 $0.599
درست ٹیسٹس
فی کوشش کامیابی کی شرح 81.3% 70.8%
غیر مستحکم ٹیسٹ 5 2
کل رنز 48 48
آؤٹ پٹ ٹوکنز 1,807 1,481
ریزننگ ٹوکنز 169,952 86,628
ردِعمل کا وقت (اوسط) 70.81s 8.89s
ردِعمل کا وقت (زیادہ سے زیادہ) 234.29s 24.21s
ردِعمل کا وقت (کل) 1132.90s 142.18s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اوسط اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اوسط اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 10.0 10.0 100.0% 0 71.35s 363 23,645
Grok 4.20 Beta 7.0 7.2 88.9% 1 3.19s 262 6,289
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 483 8,270
Grok 4.20 Beta 10.0 10.0 100.0% 0 20.93s 227 12,212
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 5.5 5.9 83.3% 1 56.99s 235 16,237
Grok 4.20 Beta 9.9 10.0 100.0% 0 4.01s 180 5,281
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 4.0 7.2 44.4% 1 146.50s 58 43,615
Grok 4.20 Beta 4.0 10.0 33.3% 0 21.33s 251 40,255
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 5.0 3.1 66.7% 1 40.05s 99 38,486
Grok 4.20 Beta 10.0 10.0 100.0% 0 5.78s 72 3,440
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 98 14,139
Grok 4.20 Beta 9.0 10.0 50.0% 0 4.97s 57 7,107
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 4.0 4.4 77.8% 2 56.74s 162 24,276
Grok 4.20 Beta 7.0 7.2 88.9% 1 3.85s 249 6,660
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 309 1,284
Grok 4.20 Beta 10.0 10.0 0.0% 0 12.39s 183 5,384

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں