نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 5 vs Google: Gemma 4 31B

خلاصہ

Claude Sonnet 5 vs Gemma 4 31B benchmark موازنہ: Gemma 4 31B average score میں آگے ہے: 6.1 vs 5.7. Gemma 4 31B کی benchmark لاگت کم ہے: $0.004 vs $0.287. Gemma 4 31B تیز ہے: 4.05s vs 4.74s، pass rates 42.9% vs 47.6%.

تجویز کردہ ماڈل: Gemma 4 31B - It has the best score here (6.1), while costing about 95.6x less than Claude Sonnet 5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-30

میٹرک Claude Sonnet 5 Claude Sonnet 5 none اجرا: 2026-06-30 Gemma 4 31B Gemma 4 31B none اجرا: 2026-04-02 مفت دستیاب
اسکور 5.7 6.1
درجہ #117 #100
اعتماد پذیری 10.0 10.0
تسلسل 8.6 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 42.9% 47.6%
غیر مستحکم ٹیسٹ 4 0
کل رنز 63 63
فی نتیجہ لاگت 4.098 0.034
کل لاگت $0.287 $0.004
ان پٹ قیمت $2.000 / 1M $0.120 / 1M
آؤٹ پٹ قیمت $10.000 / 1M $0.350 / 1M
کل ان پٹ ٹوکنز 76,797 20,911
آؤٹ پٹ ٹوکنز 13,325 1,407
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 4.74s 4.05s
ردِعمل کا وقت (زیادہ سے زیادہ) 29.46s 26.13s
ردِعمل کا وقت (کل) 99.46s 76.87s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#117 Claude Sonnet 5

none
لاگت
$0.061
وقت
53.7s
ٹوکنز
6,172 tok

#100 Gemma 4 31B

none
لاگت
$0.001
وقت
12.8s
ٹوکنز
795 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 5.3 10.0 25.0% 0 3.60s 834 1,813 0
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 852 45 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 3.0 10.0 0.0% 0 29.46s 38,775 6,340 0
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 3.01s 10,503 309 0
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 8,352 285 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 5.3 7.2 44.4% 1 3.28s 975 933 0
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 903 27 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.7 3.1 33.3% 1 2.81s 708 272 0
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 576 117 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 6.4 10.0 50.0% 0 2.58s 909 103 0
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 795 78 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 6.0 7.4 55.6% 1 3.22s 894 778 0
Gemma 4 31B 6.5 10.0 33.3% 0 4.23s 828 108 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 6.80s 12,351 522 0
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 3.0 10.0 0.0% 0 4.31s 258 391 0
Gemma 4 31B 3.0 10.0 0.0% 0 1.25s 224 12 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں