نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 5 vs Google: Gemini 3.5 Flash

خلاصہ

Claude Sonnet 5 vs Gemini 3.5 Flash benchmark موازنہ: Claude Sonnet 5 average score میں آگے ہے: 7.9 vs 7.0. Claude Sonnet 5 کی benchmark لاگت کم ہے: $0.550 vs $1.079. Gemini 3.5 Flash تیز ہے: 9.93s vs 9.94s، pass rates 79.4% vs 77.8%.

تجویز کردہ ماڈل: Claude Sonnet 5 - It has the best score here (7.9), while costing about 2.0x less than Gemini 3.5 Flash.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-30

میٹرک Claude Sonnet 5 Claude Sonnet 5 medium اجرا: 2026-06-30 Gemini 3.5 Flash Gemini 3.5 Flash none اجرا: 2026-05-19
اسکور 7.9 7.0
درجہ #30 #68
اعتماد پذیری 10.0 10.0
تسلسل 9.0 8.9
درست ٹیسٹس
فی کوشش کامیابی کی شرح 79.4% 77.8%
غیر مستحکم ٹیسٹ 3 3
کل رنز 63 63
فی نتیجہ لاگت 3.662 7.190
کل لاگت $0.550 $1.079
ان پٹ قیمت $2.000 / 1M $1.500 / 1M
آؤٹ پٹ قیمت $10.000 / 1M $9.000 / 1M
کل ان پٹ ٹوکنز 67,416 13,843
آؤٹ پٹ ٹوکنز 34,012 117,518
ریزننگ ٹوکنز 7,673 0
ردِعمل کا وقت (اوسط) 9.94s 9.93s
ردِعمل کا وقت (زیادہ سے زیادہ) 56.94s 64.36s
ردِعمل کا وقت (کل) 208.71s 178.68s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 Claude Sonnet 5

medium
لاگت
$0.007
وقت
6.4s
ٹوکنز
832 tok

#68 Gemini 3.5 Flash

none
لاگت
$0.225
وقت
125.5s
ٹوکنز
25,004 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 3.80s 834 1,220 446
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.53s 492 5,101 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
Gemini 3.5 Flash 8.8 7.8 88.9% 1 34.69s 8,122 75,927 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.5 2.1 66.7% 1 37.01s 29,394 4,848 2,170
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 3.16s 10,503 312 0
Gemini 3.5 Flash 6.5 10.0 50.0% 0 8.10s 2,781 5,895 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 7.7 10.0 66.7% 0 20.38s 975 12,140 1,994
Gemini 3.5 Flash 7.6 7.2 77.8% 1 10.64s 633 17,910 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.8 3.2 33.3% 1 4.32s 708 264 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.46s 486 1,620 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 9.9 10.0 100.0% 0 3.10s 909 318 269
Gemini 3.5 Flash 9.8 10.0 100.0% 0 3.38s 615 3,928 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 7.7 10.0 66.7% 0 2.98s 894 407 121
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.13s 558 4,640 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 10.70s 12,351 433 90
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 3.0 10.0 0.0% 0 7.06s 258 917 204
Gemini 3.5 Flash 2.8 1.6 33.3% 1 4.87s 156 2,497 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں