نیویگیشن
Advertise here

Claude Opus 4.8 (low) vs Qwen3.5-27B

average score تقریباً برابر ہے: 7.2 vs 7.2. Qwen3.5-27B کی benchmark لاگت کم ہے: $0.116 vs $3.787. Qwen3.5-27B تیز ہے: 9.98s vs 17.13s، pass rates 78.3% vs 47.8%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-10-01

موازنہ کیے گئے ماڈلز

درجہ
#143
کل آؤٹ پٹ ٹوکنز
69,489
ردِعمل کا وقت (اوسط)
17.13s
کل لاگت
$3.787
درجہ
#139
کل آؤٹ پٹ ٹوکنز
36,422
ردِعمل کا وقت (اوسط)
9.98s
کل لاگت
$0.116
تجویز کردہ ماڈل Claude Opus 4.8 (low)

It has the strongest score in this comparison (7.2) and the best overall balance of cost and response time across all 2 models.

تفصیلی موازنہ

میٹرک Claude Opus 4.8 Claude Opus 4.8 low اجرا: 2026-05-28 Qwen3.5-27B Qwen3.5-27B none اجرا: 2026-02-24
اسکور 7.2 7.2
درجہ #143 #139
اعتماد پذیری 10.0 10.0
تسلسل 8.6 9.4
کوششیں 69/69 69/69
درست ٹیسٹس
فی کوشش کامیابی کی شرح 78.3% 47.8%
غیر مستحکم ٹیسٹ 4 2
کل رنز 69 69
فی نتیجہ لاگت 23.669 1.153
کل لاگت $3.787 $0.116
ان پٹ قیمت $5.000 / 1M $0.195 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $1.560 / 1M
کل ان پٹ ٹوکنز 409,947 283,977
آؤٹ پٹ ٹوکنز 46,060 36,422
ریزننگ ٹوکنز 23,429 0
ردِعمل کا وقت (اوسط) 17.13s 9.98s
ردِعمل کا وقت (زیادہ سے زیادہ) 127.97s 124.53s
ردِعمل کا وقت (کل) 394.01s 229.52s
پیرامیٹرز ~5T کل (~500B فعال) 27B
دستیابی بند ماخذ کھلا ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#143 Claude Opus 4.8

low
لاگت
$0.031
وقت
14.1s
ٹوکنز
1,345 tok

#139 Qwen3.5-27B

none
لاگت
$0.007
وقت
42.9s
ٹوکنز
4,273 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں