نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 5 vs Qwen: Qwen3.5-Flash

خلاصہ

Claude Sonnet 5 vs Qwen3.5-Flash benchmark موازنہ: Qwen3.5-Flash average score میں آگے ہے: 6.1 vs 5.7. Qwen3.5-Flash کی benchmark لاگت کم ہے: $0.005 vs $0.287. Qwen3.5-Flash تیز ہے: 3.58s vs 4.74s، pass rates 42.9% vs 39.7%.

تجویز کردہ ماڈل: Qwen3.5-Flash - It has the best score here (6.1), while costing about 69.4x less than Claude Sonnet 5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-30

میٹرک Claude Sonnet 5 Claude Sonnet 5 none اجرا: 2026-06-30 Qwen3.5-Flash Qwen3.5-Flash none اجرا: 2026-02-24
اسکور 5.7 6.1
درجہ #117 #99
اعتماد پذیری 10.0 10.0
تسلسل 8.6 9.7
درست ٹیسٹس
فی کوشش کامیابی کی شرح 42.9% 39.7%
غیر مستحکم ٹیسٹ 4 1
کل رنز 63 63
فی نتیجہ لاگت 4.098 0.075
کل لاگت $0.287 $0.005
ان پٹ قیمت $2.000 / 1M $0.065 / 1M
آؤٹ پٹ قیمت $10.000 / 1M $0.260 / 1M
کل ان پٹ ٹوکنز 76,797 46,439
آؤٹ پٹ ٹوکنز 13,325 4,276
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 4.74s 3.58s
ردِعمل کا وقت (زیادہ سے زیادہ) 29.46s 27.18s
ردِعمل کا وقت (کل) 99.46s 75.28s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#117 Claude Sonnet 5

none
لاگت
$0.061
وقت
53.7s
ٹوکنز
6,172 tok

#99 Qwen3.5-Flash

none
لاگت
$0.003
وقت
47.4s
ٹوکنز
7,799 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 5.3 10.0 25.0% 0 3.60s 834 1,813 0
Qwen3.5-Flash 3.5 8.3 8.3% 1 1.32s 696 690 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
Qwen3.5-Flash 5.5 10.0 33.3% 0 850ms 7,913 519 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 3.0 10.0 0.0% 0 29.46s 38,775 6,340 0
Qwen3.5-Flash 3.0 10.0 0.0% 0 6.22s 18,879 1,794 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 3.01s 10,503 309 0
Qwen3.5-Flash 10.0 10.0 100.0% 0 1.57s 7,794 243 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 5.3 7.2 44.4% 1 3.28s 975 933 0
Qwen3.5-Flash 7.7 10.0 66.7% 0 905ms 789 15 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.7 3.1 33.3% 1 2.81s 708 272 0
Qwen3.5-Flash 10.0 10.0 100.0% 0 803ms 522 100 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 6.4 10.0 50.0% 0 2.58s 909 103 0
Qwen3.5-Flash 6.3 10.0 50.0% 0 8.81s 711 63 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 6.0 7.4 55.6% 1 3.22s 894 778 0
Qwen3.5-Flash 3.1 10.0 0.0% 0 10.89s 714 579 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 6.80s 12,351 522 0
Qwen3.5-Flash 10.0 10.0 100.0% 0 3.67s 8,211 264 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 3.0 10.0 0.0% 0 4.31s 258 391 0
Qwen3.5-Flash 3.0 10.0 0.0% 0 588ms 210 9 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں