नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Google: Gemini 3.5 Flash

सारांश

Claude Opus 4.8 vs Gemini 3.5 Flash benchmark तुलना: Gemini 3.5 Flash average score मध्ये पुढे आहे: 9.8 vs 7.7. Gemini 3.5 Flash चा benchmark खर्च कमी आहे: $1.115 vs $1.270. Gemini 3.5 Flash वेगवान आहे: 8.84s vs 10.83s, pass rates 79.4% vs 96.8%.

शिफारस केलेले मॉडेल: Gemini 3.5 Flash - It has the strongest score in this comparison (9.8) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-30

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 low प्रकाशन: 2026-05-28 Gemini 3.5 Flash Gemini 3.5 Flash high प्रकाशन: 2026-05-19
स्कोअर 7.7 9.8
क्रमांक #38 #1
विश्वसनीयता 10.0 10.0
सुसंगतता 8.8 9.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 79.4% 96.8%
अस्थिर चाचण्या 3 1
एकूण रन 63 63
प्रति निकाल खर्च 8.466 5.575
एकूण खर्च $1.270 $1.115
इनपुट किंमत $5.000 / 1M $1.500 / 1M
आउटपुट किंमत $25.000 / 1M $9.000 / 1M
एकूण इनपुट टोकन्स 60,946 37,594
आउटपुट टोकन्स 31,771 1,975
रिझनिंग टोकन्स 6,831 115,638
प्रतिसाद वेळ (सरासरी) 10.83s 8.84s
प्रतिसाद वेळ (कमाल) 127.97s 34.82s
प्रतिसाद वेळ (एकूण) 227.39s 185.57s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#38 Claude Opus 4.8

low
खर्च
$0.031
वेळ
14.1s
टोकन्स
1,345 tok

#1 Gemini 3.5 Flash

high
खर्च
$0.208
वेळ
118.2s
टोकन्स
23,158 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 3.30s 834 793 371
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.57s 492 174 4,997
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.96s 8,118 456 47,129
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 9.8 10.0 100.0% 0 20.84s 23,500 2,216 1,081
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.37s 12,873 351 16,323
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 6.3 5.8 66.7% 1 2.27s 10,503 310 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.43s 7,548 279 8,466
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 5.3 10.0 33.3% 0 45.53s 975 23,311 3,908
Gemini 3.5 Flash 7.6 7.2 77.8% 1 14.09s 633 12 24,721
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 2.55s 708 231 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.63s 486 115 1,650
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 9.8 10.0 100.0% 0 2.78s 909 111 221
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.35s 615 70 3,799
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 3.01s 894 592 184
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.23s 558 241 4,940
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 6.85s 11,775 370 35
Gemini 3.5 Flash 9.8 10.0 100.0% 0 4.96s 6,115 265 1,608
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 3.0 10.0 0.0% 0 5.48s 258 200 222
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.94s 156 12 2,005

झटपट तुलना

तुलना जोडी बदला