نیویگیشن
AI BENCHY
Your ad here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 3 Flash Preview

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-04-26

میٹرک Seed-2.0-Lite Seed-2.0-Lite medium اجرا: 2026-02-14 Gemini 3 Flash Preview Gemini 3 Flash Preview none اجرا: 2025-12-17
اسکور 8.6 8.1
درجہ #8 #25
اعتماد پذیری دستیاب نہیں دستیاب نہیں
تسلسل 8.8 9.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 83.3% 77.8%
غیر مستحکم ٹیسٹ 3 2
کل رنز 54 54
فی نتیجہ لاگت 0.926 0.156
کل لاگت $0.121 $0.021
?? ?? ???? $0.250 / 1M $0.500 / 1M
??? ?? ???? $2.000 / 1M $3.000 / 1M
آؤٹ پٹ ٹوکنز 3,257 1,840
ریزننگ ٹوکنز 52,042 0
ردِعمل کا وقت (اوسط) 30.37s 1.65s
ردِعمل کا وقت (زیادہ سے زیادہ) 168.71s 3.56s
ردِعمل کا وقت (کل) 546.72s 18.20s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 8.3 10.0 75.0% 0 17.99s 996 7,142
Gemini 3 Flash Preview 8.3 10.0 75.0% 0 1.25s 214 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 74.49s 436 7,319
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.59s 423 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
Gemini 3 Flash Preview 4.7 1.6 66.7% 1 3.56s 350 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 9.07s 246 1,742
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.41s 279 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 5.9 7.2 55.6% 1 88.74s 15 23,897
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 963ms 18 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 6.7 3.6 66.7% 1 18.25s 304 1,620
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.13s 104 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
Gemini 3 Flash Preview 6.4 5.8 66.7% 1 1.58s 74 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 9.0 7.9 88.9% 1 11.03s 461 3,532
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 1.06s 144 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.35s 234 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں