نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Qwen: Qwen3.6 Flash

خلاصہ

Claude Opus 4.8 vs Qwen3.6 Flash benchmark موازنہ: Qwen3.6 Flash average score میں آگے ہے: 7.5 vs 7.0. Qwen3.6 Flash کی benchmark لاگت کم ہے: $0.288 vs $0.539. Claude Opus 4.8 تیز ہے: 3.47s vs 19.25s، pass rates 61.9% vs 71.4%.

تجویز کردہ ماڈل: Qwen3.6 Flash - It has the best score here (7.5), while costing about 1.9x less than Claude Opus 4.8.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-10

میٹرک Claude Opus 4.8 Claude Opus 4.8 none اجرا: 2026-05-28 Qwen3.6 Flash Qwen3.6 Flash medium اجرا: 2026-04-20
اسکور 7.0 7.5
درجہ #69 #40
اعتماد پذیری 10.0 10.0
تسلسل 9.2 8.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 61.9% 71.4%
غیر مستحکم ٹیسٹ 2 5
کل رنز 63 63
فی نتیجہ لاگت 4.485 3.030
کل لاگت $0.539 $0.288
ان پٹ قیمت $5.000 / 1M $0.188 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $1.125 / 1M
کل ان پٹ ٹوکنز 67,104 42,362
آؤٹ پٹ ٹوکنز 8,107 2,995
ریزننگ ٹوکنز 0 245,358
ردِعمل کا وقت (اوسط) 3.47s 19.25s
ردِعمل کا وقت (زیادہ سے زیادہ) 17.73s 122.87s
ردِعمل کا وقت (کل) 72.90s 404.20s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Claude Opus 4.8

none
Cost
$0.053
Time
22.0s
Tokens
2,253 tok

#40 Qwen3.6 Flash

medium
Invalid SVG
Cost
$0.008
Time
29.9s
Tokens
6,784 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 834 1,472 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.10s 672 624 14,024
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
Qwen3.6 Flash 5.0 5.1 44.5% 2 42.85s 7,895 495 67,967
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 29,658 3,259 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 20.28s 14,934 483 13,839
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 10,503 308 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 9.65s 7,782 270 13,155
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 975 61 0
Qwen3.6 Flash 3.5 4.4 33.3% 2 14.65s 771 60 24,409
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 708 230 0
Qwen3.6 Flash 4.8 9.9 0.0% 0 9.88s 516 140 5,445
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 909 95 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.05s 699 102 7,423
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 894 783 0
Qwen3.6 Flash 8.2 7.2 88.9% 1 6.29s 696 460 10,860
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 11,775 355 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 4.00s 8,193 335 1,188
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 258 212 0
Qwen3.6 Flash 3.0 10.0 0.0% 0 122.87s 204 26 87,048

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں