نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Qwen: Qwen3.7 Plus

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-03

میٹرک Claude Opus 4.8 Claude Opus 4.8 medium اجرا: 2026-05-28 Qwen3.7 Plus Qwen3.7 Plus medium اجرا: 2026-06-03
اسکور 8.7 8.4
درجہ #11 #16
اعتماد پذیری 10.0 9.9
تسلسل 9.6 9.2
درست ٹیسٹس
فی کوشش کامیابی کی شرح 83.3% 80.0%
غیر مستحکم ٹیسٹ 1 2
کل رنز 60 60
فی نتیجہ لاگت 6.285 1.324
کل لاگت $1.006 $0.199
ان پٹ قیمت $5.000 / 1M $0.400 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $1.600 / 1M
کل ان پٹ ٹوکنز 57,185 38,104
آؤٹ پٹ ٹوکنز 23,201 2,107
ریزننگ ٹوکنز 5,901 112,479
ردِعمل کا وقت (اوسط) 9.34s 36.84s
ردِعمل کا وقت (زیادہ سے زیادہ) 38.03s 178.04s
ردِعمل کا وقت (کل) 186.84s 736.86s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 3.95s 834 1,179 478
Qwen3.7 Plus 10.0 10.0 100.0% 0 8.58s 672 195 5,065
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 14.97s 6,768 6,651 1,381
Qwen3.7 Plus 6.5 5.9 66.7% 1 122.40s 3,637 396 30,301
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.8 10.0 100.0% 0 38.03s 23,561 5,260 1,588
Qwen3.7 Plus 10.0 10.0 100.0% 0 65.24s 14,934 366 10,132
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.1 5.6 83.3% 1 12.29s 10,503 481 312
Qwen3.7 Plus 10.0 10.0 100.0% 0 21.75s 7,782 270 6,713
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 5.3 10.0 33.3% 0 14.15s 975 7,477 900
Qwen3.7 Plus 3.6 7.2 22.2% 1 45.35s 771 57 27,073
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 2.46s 708 237 0
Qwen3.7 Plus 10.0 10.0 100.0% 0 25.48s 516 123 3,998
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 3.32s 909 373 320
Qwen3.7 Plus 10.0 10.0 100.0% 0 16.13s 699 102 5,013
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 3.95s 894 791 483
Qwen3.7 Plus 10.0 10.0 100.0% 0 16.38s 696 280 7,312
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 8.96s 11,775 301 225
Qwen3.7 Plus 10.0 10.0 100.0% 0 15.02s 8,193 292 1,831
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 3.0 10.0 0.0% 0 6.14s 258 451 214
Qwen3.7 Plus 3.0 10.0 0.0% 0 91.07s 204 26 15,041

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں