نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Z.ai: GLM 5.2

خلاصہ

Claude Sonnet 4.6 vs GLM 5.2 benchmark موازنہ: Claude Sonnet 4.6 average score میں آگے ہے: 7.8 vs 7.1. GLM 5.2 کی benchmark لاگت کم ہے: $0.051 vs $1.418. GLM 5.2 تیز ہے: 6.34s vs 17.06s، pass rates 65.1% vs 60.3%.

تجویز کردہ ماڈل: GLM 5.2 - Its score stays close to the best score here (7.1 vs 7.8), while costing about 28.1x less than Claude Sonnet 4.6.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-02

میٹرک Claude Sonnet 4.6 Claude Sonnet 4.6 medium اجرا: 2026-02-17 GLM 5.2 GLM 5.2 none اجرا: 2026-06-17
اسکور 7.8 7.1
درجہ #32 #63
اعتماد پذیری 10.0 9.9
تسلسل 9.1 9.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.1% 60.3%
غیر مستحکم ٹیسٹ 2 1
کل رنز 63 63
فی نتیجہ لاگت 10.904 0.628
کل لاگت $1.418 $0.051
ان پٹ قیمت $3.000 / 1M $0.930 / 1M
آؤٹ پٹ قیمت $15.000 / 1M $3.000 / 1M
کل ان پٹ ٹوکنز 49,112 38,671
آؤٹ پٹ ٹوکنز 54,703 4,817
ریزننگ ٹوکنز 29,970 0
ردِعمل کا وقت (اوسط) 17.06s 6.34s
ردِعمل کا وقت (زیادہ سے زیادہ) 46.35s 20.69s
ردِعمل کا وقت (کل) 221.83s 133.19s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 Claude Sonnet 4.6

medium
غلط SVG
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

#63 GLM 5.2

none
غلط SVG
لاگت
$0.033
وقت
87.7s
ٹوکنز
7,455 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 789 1,046 1,093
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 18,351 5,871 3,962
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 8,676 649 742
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 471 25,790 16,919
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 564 256 433
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 792 318 552
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 5.31s 816 592 646
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 11,454 655 351
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 3.0 10.0 0.0% 0 30.09s 204 3,437 1,586
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں