نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.6 vs Google: Gemini 3.5 Flash

خلاصہ

Claude Opus 4.6 vs Gemini 3.5 Flash benchmark موازنہ: Claude Opus 4.6 average score میں آگے ہے: 7.7 vs 7.0. Gemini 3.5 Flash کی benchmark لاگت کم ہے: $1.079 vs $2.053. Gemini 3.5 Flash تیز ہے: 9.93s vs 25.89s، pass rates 61.9% vs 77.8%.

تجویز کردہ ماڈل: Gemini 3.5 Flash - Its score stays close to the best score here (7.0 vs 7.7), while costing about 1.9x less than Claude Opus 4.6.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک Claude Opus 4.6 Claude Opus 4.6 medium اجرا: 2026-02-05 Gemini 3.5 Flash Gemini 3.5 Flash none اجرا: 2026-05-19
اسکور 7.7 7.0
درجہ #38 #66
اعتماد پذیری 10.0 10.0
تسلسل 8.8 8.9
درست ٹیسٹس
فی کوشش کامیابی کی شرح 61.9% 77.8%
غیر مستحکم ٹیسٹ 3 3
کل رنز 63 63
فی نتیجہ لاگت 17.103 7.190
کل لاگت $2.053 $1.079
ان پٹ قیمت $5.000 / 1M $1.500 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $9.000 / 1M
کل ان پٹ ٹوکنز 53,227 13,843
آؤٹ پٹ ٹوکنز 47,446 117,518
ریزننگ ٹوکنز 24,000 0
ردِعمل کا وقت (اوسط) 25.89s 9.93s
ردِعمل کا وقت (زیادہ سے زیادہ) 83.40s 64.36s
ردِعمل کا وقت (کل) 362.49s 178.68s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#38 Claude Opus 4.6

medium
غلط SVG
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

#66 Gemini 3.5 Flash

none
لاگت
$0.225
وقت
125.5s
ٹوکنز
25,004 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 6.4 5.8 66.7% 2 7.45s 840 986 1,071
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.53s 492 5,101 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
Gemini 3.5 Flash 8.8 7.8 88.9% 1 34.69s 8,122 75,927 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 10.0 10.0 100.0% 0 76.66s 20,685 8,178 5,194
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 10.0 10.0 100.0% 0 7.37s 8,676 691 757
Gemini 3.5 Flash 6.5 10.0 50.0% 0 8.10s 2,781 5,895 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 3.0 10.0 0.0% 0 83.40s 674 14,642 8,687
Gemini 3.5 Flash 7.6 7.2 77.8% 1 10.64s 633 17,910 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 10.0 10.0 100.0% 0 5.04s 564 188 292
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.46s 486 1,620 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 10.0 10.0 100.0% 0 2.43s 792 266 467
Gemini 3.5 Flash 9.8 10.0 100.0% 0 3.38s 615 3,928 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 7.7 10.0 66.7% 0 4.71s 816 532 630
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.13s 558 4,640 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 10.0 10.0 100.0% 0 9.73s 11,454 861 329
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 3.0 10.0 0.0% 0 63.24s 204 8,045 2,452
Gemini 3.5 Flash 2.8 1.6 33.3% 1 4.87s 156 2,497 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں