نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Qwen: Qwen3.5-122B-A10B

خلاصہ

Seed-2.0-Lite vs Qwen3.5-122B-A10B benchmark موازنہ: Seed-2.0-Lite average score میں آگے ہے: 6.2 vs 5.3. Seed-2.0-Lite کی benchmark لاگت کم ہے: $0.019 vs $0.020. Seed-2.0-Lite تیز ہے: 2.49s vs 3.41s، pass rates 46.0% vs 31.8%.

تجویز کردہ ماڈل: Seed-2.0-Lite - It has the strongest score in this comparison (6.2) and the best overall balance of cost and response time across all 2 models.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک Seed-2.0-Lite Seed-2.0-Lite none اجرا: 2026-02-14 Qwen3.5-122B-A10B Qwen3.5-122B-A10B none اجرا: 2026-02-24
اسکور 6.2 5.3
درجہ #92 #125
اعتماد پذیری 10.0 10.0
تسلسل 8.4 9.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 46.0% 31.8%
غیر مستحکم ٹیسٹ 4 1
کل رنز 63 63
فی نتیجہ لاگت 0.228 0.393
کل لاگت $0.019 $0.020
ان پٹ قیمت $0.250 / 1M $0.260 / 1M
آؤٹ پٹ قیمت $2.000 / 1M $2.080 / 1M
کل ان پٹ ٹوکنز 46,573 47,735
آؤٹ پٹ ٹوکنز 3,259 3,383
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 2.49s 3.41s
ردِعمل کا وقت (زیادہ سے زیادہ) 6.70s 46.00s
ردِعمل کا وقت (کل) 52.26s 71.59s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 Seed-2.0-Lite

none
لاگت
$0.005
وقت
83.8s
ٹوکنز
2,311 tok

#125 Qwen3.5-122B-A10B

none
لاگت
$0.016
وقت
44.5s
ٹوکنز
6,431 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 3.0 5.9 16.7% 2 2.43s 894 709 0
Qwen3.5-122B-A10B 4.8 10.0 25.0% 0 1.59s 696 312 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 5.6 10.0 33.3% 0 2.83s 8,215 410 0
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 3.0 10.0 0.0% 0 6.59s 16,215 498 0
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 46.00s 20,175 1,137 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.82s 8,538 246 0
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 1.01s 7,794 243 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 3.6 7.2 22.2% 1 1.33s 939 17 0
Qwen3.5-122B-A10B 5.3 10.0 33.3% 0 465ms 789 15 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.45s 570 294 0
Qwen3.5-122B-A10B 5.0 10.0 0.0% 0 1.12s 522 66 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.06s 810 73 0
Qwen3.5-122B-A10B 6.3 10.0 50.0% 0 513ms 711 69 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 5.3 7.2 44.4% 1 2.78s 858 709 0
Qwen3.5-122B-A10B 3.8 10.0 0.0% 0 1.00s 714 575 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.94s 9,270 292 0
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 2.04s 8,211 264 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 3.0 10.0 0.0% 0 1.96s 264 11 0
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 295ms 210 9 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں