نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs OpenAI: GPT-5.2 Chat

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-03-12

میٹرک Seed-2.0-Lite Seed-2.0-Lite medium اجرا: 2026-02-14 GPT-5.2 Chat GPT-5.2 Chat none اجرا: 2025-12-11
درجہ #3 #16
اوسط اسکور 8.5 7.4
تسلسل 8.7 9.1
فی نتیجہ لاگت 0.870 2.440
کل لاگت $0.105 $0.269
درست ٹیسٹس
فی کوشش کامیابی کی شرح 87.5% 75.0%
غیر مستحکم ٹیسٹ 3 2
کل رنز 48 48
آؤٹ پٹ ٹوکنز 2,815 15,845
ریزننگ ٹوکنز 44,618 0
ردِعمل کا وقت (اوسط) 29.39s 7.03s
ردِعمل کا وقت (زیادہ سے زیادہ) 168.71s 38.52s
ردِعمل کا وقت (کل) 470.29s 112.51s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اوسط اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اوسط اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 23.34s 990 7,037
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.97s 1,651 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 1,243 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 9.9 10.0 100.0% 0 9.07s 246 1,742
GPT-5.2 Chat 9.9 10.0 100.0% 0 3.05s 980 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 4.0 7.2 55.6% 1 88.74s 15 23,897
GPT-5.2 Chat 4.0 10.0 33.3% 0 17.78s 7,810 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 7.0 3.6 66.7% 1 18.25s 304 1,620
GPT-5.2 Chat 4.0 3.0 33.3% 1 3.20s 335 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
GPT-5.2 Chat 6.0 6.1 83.3% 1 5.46s 1,528 0
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 9.3 7.9 88.9% 1 11.03s 461 3,532
GPT-5.2 Chat 7.0 10.0 66.7% 0 4.42s 1,743 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 555 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں