نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 5 vs Qwen: Qwen3.7 Plus

خلاصہ

Claude Sonnet 5 vs Qwen3.7 Plus benchmark موازنہ: Claude Sonnet 5 average score میں آگے ہے: 7.9 vs 7.2. Qwen3.7 Plus کی benchmark لاگت کم ہے: $0.023 vs $0.550. Qwen3.7 Plus تیز ہے: 2.85s vs 9.94s، pass rates 79.4% vs 47.6%.

تجویز کردہ ماڈل: Qwen3.7 Plus - Its score stays close to the best score here (7.2 vs 7.9), while costing about 24.9x less than Claude Sonnet 5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-30

میٹرک Claude Sonnet 5 Claude Sonnet 5 medium اجرا: 2026-06-30 Qwen3.7 Plus Qwen3.7 Plus none اجرا: 2026-06-03
اسکور 7.9 7.2
درجہ #30 #62
اعتماد پذیری 10.0 10.0
تسلسل 9.0 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 79.4% 47.6%
غیر مستحکم ٹیسٹ 3 0
کل رنز 63 63
فی نتیجہ لاگت 3.662 0.276
کل لاگت $0.550 $0.023
ان پٹ قیمت $2.000 / 1M $0.320 / 1M
آؤٹ پٹ قیمت $10.000 / 1M $1.280 / 1M
کل ان پٹ ٹوکنز 67,416 42,510
آؤٹ پٹ ٹوکنز 34,012 6,578
ریزننگ ٹوکنز 7,673 0
ردِعمل کا وقت (اوسط) 9.94s 2.85s
ردِعمل کا وقت (زیادہ سے زیادہ) 56.94s 29.38s
ردِعمل کا وقت (کل) 208.71s 59.86s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 Claude Sonnet 5

medium
لاگت
$0.007
وقت
6.4s
ٹوکنز
832 tok

#62 Qwen3.7 Plus

none
لاگت
$0.019
وقت
213.5s
ٹوکنز
11,960 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 3.80s 834 1,220 446
Qwen3.7 Plus 6.5 10.0 50.0% 0 1.38s 696 349 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.5 2.1 66.7% 1 37.01s 29,394 4,848 2,170
Qwen3.7 Plus 10.0 10.0 100.0% 0 29.38s 14,952 4,505 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 3.16s 10,503 312 0
Qwen3.7 Plus 10.0 10.0 100.0% 0 1.43s 7,794 243 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 7.7 10.0 66.7% 0 20.38s 975 12,140 1,994
Qwen3.7 Plus 3.0 10.0 0.0% 0 868ms 789 18 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.8 3.2 33.3% 1 4.32s 708 264 0
Qwen3.7 Plus 5.3 10.0 0.0% 0 1.33s 522 78 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 9.9 10.0 100.0% 0 3.10s 909 318 269
Qwen3.7 Plus 6.3 10.0 50.0% 0 929ms 711 72 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 7.7 10.0 66.7% 0 2.98s 894 407 121
Qwen3.7 Plus 7.7 10.0 66.7% 0 1.71s 714 443 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 10.70s 12,351 433 90
Qwen3.7 Plus 10.0 10.0 100.0% 0 3.54s 8,211 222 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 3.0 10.0 0.0% 0 7.06s 258 917 204
Qwen3.7 Plus 3.0 10.0 0.0% 0 1.21s 210 9 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں