نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs Z.ai: GLM 5.2

خلاصہ

Seed-2.0-Mini vs GLM 5.2 benchmark موازنہ: Seed-2.0-Mini average score میں آگے ہے: 7.4 vs 7.1. Seed-2.0-Mini کی benchmark لاگت کم ہے: $0.044 vs $0.076. GLM 5.2 تیز ہے: 6.34s vs 80.22s، pass rates 57.1% vs 60.3%.

تجویز کردہ ماڈل: GLM 5.2 - Its score stays close to the best score here (7.1 vs 7.4), while responding about 12.6x faster than Seed-2.0-Mini.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-17

میٹرک Seed-2.0-Mini Seed-2.0-Mini medium اجرا: 2026-02-14 GLM 5.2 GLM 5.2 none اجرا: 2026-06-17
اسکور 7.4 7.1
درجہ #50 #61
اعتماد پذیری 6.7 9.9
تسلسل 9.3 9.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 57.1% 60.3%
غیر مستحکم ٹیسٹ 2 1
کل رنز 63 63
فی نتیجہ لاگت 0.397 0.628
کل لاگت $0.044 $0.076
ان پٹ قیمت $0.100 / 1M $1.400 / 1M
آؤٹ پٹ قیمت $0.400 / 1M $4.400 / 1M
کل ان پٹ ٹوکنز 41,904 38,671
آؤٹ پٹ ٹوکنز 2,555 4,817
ریزننگ ٹوکنز 95,974 0
ردِعمل کا وقت (اوسط) 80.22s 6.34s
ردِعمل کا وقت (زیادہ سے زیادہ) 262.83s 20.69s
ردِعمل کا وقت (کل) 1363.72s 133.19s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 Seed-2.0-Mini

medium
Cost
$0.002
Time
161.7s
Tokens
4,379 tok

#61 GLM 5.2

none
Invalid SVG
Cost
$0.033
Time
87.7s
Tokens
7,455 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Mini 6.6 10.0 50.0% 0 74.75s 791 360 9,520
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Mini 5.5 9.8 33.3% 0 220.48s 3,823 464 34,964
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Mini 10.0 10.0 100.0% 0 262.83s 16,533 404 29,806
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Mini 10.0 10.0 100.0% 0 24.27s 8,568 246 2,743
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Mini 3.0 10.0 0.0% 0 0ms 0 0 0
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Mini 5.1 3.4 33.3% 1 36.65s 585 213 4,210
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Mini 10.0 10.0 100.0% 0 17.47s 840 69 2,050
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Mini 8.2 7.2 88.9% 1 31.79s 903 527 5,667
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Mini 10.0 10.0 100.0% 0 88.68s 9,585 222 5,235
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Seed-2.0-Mini 3.0 10.0 0.0% 0 56.76s 276 50 1,779
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں