نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs OpenAI: GPT-5.4

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-03-15

میٹرک Seed-2.0-Lite Seed-2.0-Lite medium اجرا: 2026-02-14 GPT-5.4 GPT-5.4 medium اجرا: 2026-03-05
درجہ #3 #9
اسکور 8.8 8.5
تسلسل 8.7 8.5
فی نتیجہ لاگت 0.870 6.601
کل لاگت $0.105 $0.793
درست ٹیسٹس
فی کوشش کامیابی کی شرح 87.5% 83.3%
غیر مستحکم ٹیسٹ 3 3
کل رنز 48 48
آؤٹ پٹ ٹوکنز 2,815 1,756
ریزننگ ٹوکنز 44,618 46,642
ردِعمل کا وقت (اوسط) 29.39s 20.05s
ردِعمل کا وقت (زیادہ سے زیادہ) 168.71s 100.41s
ردِعمل کا وقت (کل) 470.29s 320.87s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 23.34s 990 7,037
GPT-5.4 10.0 10.0 100.0% 0 5.02s 216 1,466
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 9.07s 246 1,742
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 5.9 7.2 55.6% 1 88.74s 15 23,897
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 6.7 3.6 66.7% 1 18.25s 304 1,620
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 9.0 7.9 88.9% 1 11.03s 461 3,532
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں