نیویگیشن
AI BENCHY
Advertise here

Seed-2.0-Code (low) vs Qwen3.8 27B (medium)

Qwen3.8 27B (medium) average score میں آگے ہے: 7.8 vs 7.7. مقامی ہارڈویئر کی لاگت نہیں ناپی گئی، اس لیے لاگت کا موازنہ دستیاب نہیں ہے۔ Qwen3.8 27B (medium) تیز ہے: 33.05s vs 72.24s، pass rates 77.3% vs 66.7%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-15

درجہ
#73
کل آؤٹ پٹ ٹوکنز
241,309
ردِعمل کا وقت (اوسط)
72.24s
کل لاگت
$0.767
درجہ
#68
کل آؤٹ پٹ ٹوکنز
136,162
ردِعمل کا وقت (اوسط)
33.05s
کل لاگت
دستیاب نہیں
تجویز کردہ ماڈل Qwen3.8 27B (medium)

It has the best score here (7.8), while responding about 2.2x faster than Seed-2.0-Code (low).

تفصیلی موازنہ

میٹرک Seed-2.0-Code Seed-2.0-Code low اجرا: 2026-08-12 Qwen3.8 27B Qwen3.8 27B medium اجرا: 2026-08-14
اسکور 7.7 7.8
درجہ #73 #68
اعتماد پذیری 8.5 9.6
تسلسل 7.8 9.7
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 77.3% 66.7%
غیر مستحکم ٹیسٹ 6 1
کل رنز 66 66
فی نتیجہ لاگت 5.899 دستیاب نہیں
کل لاگت $0.767 دستیاب نہیں
ان پٹ قیمت $0.500 / 1M دستیاب نہیں
آؤٹ پٹ قیمت $3.000 / 1M دستیاب نہیں
کل ان پٹ ٹوکنز 85,657 98,266
آؤٹ پٹ ٹوکنز 8,142 1,861
ریزننگ ٹوکنز 233,167 134,301
ردِعمل کا وقت (اوسط) 72.24s 33.05s
ردِعمل کا وقت (زیادہ سے زیادہ) 485.92s 214.63s
ردِعمل کا وقت (کل) 1589.31s 694.04s
پیرامیٹرز ~200B کل (~20B فعال) 27.3B
دستیابی بند ماخذ وزن دستیاب

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#73 Seed-2.0-Code

low
Provider returned error
لاگت
$0.000
وقت
0.3s
ٹوکنز
0 tok

#68 Qwen3.8 27B

medium
لاگت
دستیاب نہیں
وقت
43.4s
ٹوکنز
2,956 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Code 7.0 7.1 55.6% 1 109.70s 7,948 455 55,759
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں