نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Google: Gemini 3 Flash Preview

خلاصہ

Claude Opus 4.7 vs Gemini 3 Flash Preview benchmark موازنہ: Gemini 3 Flash Preview average score میں آگے ہے: 9.8 vs 8.7. Gemini 3 Flash Preview کی benchmark لاگت کم ہے: $0.667 vs $0.679. Claude Opus 4.7 تیز ہے: 4.73s vs 18.64s، pass rates 82.5% vs 98.4%.

تجویز کردہ ماڈل: Claude Opus 4.7 - It offers the best overall trade-off: a competitive score (8.7), faster response than Gemini 3 Flash Preview, and balanced cost.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-04

میٹرک Claude Opus 4.7 Claude Opus 4.7 medium اجرا: 2026-04-16 Gemini 3 Flash Preview Gemini 3 Flash Preview medium اجرا: 2025-12-17
اسکور 8.7 9.8
درجہ #11 #1
اعتماد پذیری 10.0 10.0
تسلسل 9.6 9.7
درست ٹیسٹس
فی کوشش کامیابی کی شرح 82.5% 98.4%
غیر مستحکم ٹیسٹ 1 1
کل رنز 63 63
فی نتیجہ لاگت 3.991 3.335
کل لاگت $0.679 $0.667
ان پٹ قیمت $5.000 / 1M $0.500 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $3.000 / 1M
کل ان پٹ ٹوکنز 65,406 37,017
آؤٹ پٹ ٹوکنز 11,858 2,006
ریزننگ ٹوکنز 2,198 214,153
ردِعمل کا وقت (اوسط) 4.73s 18.64s
ردِعمل کا وقت (زیادہ سے زیادہ) 23.18s 117.26s
ردِعمل کا وقت (کل) 94.51s 391.35s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 4.7

medium
Cost
$0.059
Time
26.8s
Tokens
2,475 tok

#1 Gemini 3 Flash Preview

medium
Cost
$0.010
Time
17.9s
Tokens
3,236 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 894 348 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.88s 494 330 3,216
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Gemini 3 Flash Preview 8.6 7.6 88.9% 1 84.40s 8,122 462 161,084
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 24,501 2,369 1,084
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 22.42s 12,873 351 10,485
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 10,533 324 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.43s 7,548 279 4,893
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 630 51 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 15.27s 633 12 21,684
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 723 256 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.19s 486 72 1,905
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 939 114 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.04s 615 72 2,709
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 2.43s 939 370 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.05s 558 183 4,365
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 15,339 373 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 12.60s 5,532 234 1,487
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 3.0 10.0 0.0% 0 2.25s 273 24 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.50s 156 11 2,325

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں