نیویگیشن
AI BENCHY
Advertise here

Seed-2.0-Lite (medium) vs Qwen3.8 27B (medium)

average score تقریباً برابر ہے: 7.8 vs 7.8. مقامی ہارڈویئر کی لاگت نہیں ناپی گئی، اس لیے لاگت کا موازنہ دستیاب نہیں ہے۔ Qwen3.8 27B (medium) تیز ہے: 33.05s vs 47.94s، pass rates 69.7% vs 66.7%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-15

درجہ
#69
کل آؤٹ پٹ ٹوکنز
101,296
ردِعمل کا وقت (اوسط)
47.94s
کل لاگت
$0.236
درجہ
#68
کل آؤٹ پٹ ٹوکنز
136,162
ردِعمل کا وقت (اوسط)
33.05s
کل لاگت
دستیاب نہیں
تجویز کردہ ماڈل Seed-2.0-Lite (medium)

It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.

تفصیلی موازنہ

میٹرک Seed-2.0-Lite Seed-2.0-Lite medium اجرا: 2026-02-14 Qwen3.8 27B Qwen3.8 27B medium اجرا: 2026-08-14
اسکور 7.8 7.8
درجہ #69 #68
اعتماد پذیری 10.0 9.6
تسلسل 8.6 9.7
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 69.7% 66.7%
غیر مستحکم ٹیسٹ 4 1
کل رنز 66 66
فی نتیجہ لاگت 1.809 دستیاب نہیں
کل لاگت $0.236 دستیاب نہیں
ان پٹ قیمت $0.250 / 1M دستیاب نہیں
آؤٹ پٹ قیمت $2.000 / 1M دستیاب نہیں
کل ان پٹ ٹوکنز 129,906 98,266
آؤٹ پٹ ٹوکنز 12,530 1,861
ریزننگ ٹوکنز 88,766 134,301
ردِعمل کا وقت (اوسط) 47.94s 33.05s
ردِعمل کا وقت (زیادہ سے زیادہ) 254.92s 214.63s
ردِعمل کا وقت (کل) 1054.57s 694.04s
پیرامیٹرز ~200B کل (~20B فعال) 27.3B
دستیابی بند ماخذ وزن دستیاب

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Seed-2.0-Lite

medium
لاگت
$0.005
وقت
86.7s
ٹوکنز
2,354 tok

#68 Qwen3.8 27B

medium
لاگت
دستیاب نہیں
وقت
43.4s
ٹوکنز
2,956 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں

Claude Opus 4.8lowvsSeed-2.0-LitemediumSeed-2.0-LitemediumvsQwen3.7 FlashhighClaude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 ProhighDeepSeek V4 ProhighvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 Flash 0423highGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27BmediumSeed-2.0-LitemediumvsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BmediumSeed-2.0-LitemediumvsGPT-5.2 Chatnone