नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 4.8 vs Gemini 3.1 Pro Preview (medium)

Gemini 3.1 Pro Preview (medium) average score मध्ये पुढे आहे: 9.2 vs 7.3. Claude Opus 4.8 चा benchmark खर्च कमी आहे: $1.166 vs $1.361. Claude Opus 4.8 वेगवान आहे: 4.91s vs 21.47s, pass rates 63.6% vs 90.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#74
एकूण आउटपुट टोकन्स
16,797
प्रतिसाद वेळ (सरासरी)
4.91s
एकूण खर्च
$1.166
क्रमांक
#10
एकूण आउटपुट टोकन्स
97,958
प्रतिसाद वेळ (सरासरी)
21.47s
एकूण खर्च
$1.361
शिफारस केलेले मॉडेल Gemini 3.1 Pro Preview (medium)

It has the strongest score in this comparison (9.2) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 none प्रकाशन: 2026-05-28 Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium प्रकाशन: 2026-02-19
स्कोअर 7.3 9.2
क्रमांक #74 #10
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 90.9%
अस्थिर चाचण्या 2 0
एकूण रन 66 66
प्रति निकाल खर्च 8.969 6.801
एकूण खर्च $1.166 $1.361
इनपुट किंमत $5.000 / 1M $2.000 / 1M
आउटपुट किंमत $25.000 / 1M $12.000 / 1M
एकूण इनपुट टोकन्स 149,206 92,287
आउटपुट टोकन्स 16,797 5,232
रिझनिंग टोकन्स 0 92,726
प्रतिसाद वेळ (सरासरी) 4.91s 21.47s
प्रतिसाद वेळ (कमाल) 35.03s 88.68s
प्रतिसाद वेळ (एकूण) 108.03s 322.08s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Claude Opus 4.8

none
खर्च
$0.053
वेळ
22.0s
टोकन्स
2,253 tok

#10 Gemini 3.1 Pro Preview

medium
खर्च
$0.115
वेळ
87.2s
टोकन्स
9,629 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247

झटपट तुलना

तुलना जोडी बदला