नेविगेशन
AI BENCHY
Advertise here

Claude Opus 4.8 vs Gemini 3.1 Pro Preview (medium)

Gemini 3.1 Pro Preview (medium) average score में आगे है: 9.2 vs 7.3. Claude Opus 4.8 की benchmark लागत कम है: $1.166 vs $1.361. Claude Opus 4.8 तेज है: 4.91s vs 21.47s, pass rates 63.6% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#74
कुल आउटपुट टोकन
16,797
प्रतिक्रिया समय (औसत)
4.91s
कुल लागत
$1.166
रैंक
#10
कुल आउटपुट टोकन
97,958
प्रतिक्रिया समय (औसत)
21.47s
कुल लागत
$1.361
अनुशंसित मॉडल Gemini 3.1 Pro Preview (medium)

It has the strongest score in this comparison (9.2) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 none रिलीज़: 2026-05-28 Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium रिलीज़: 2026-02-19
स्कोर 7.3 9.2
रैंक #74 #10
विश्वसनीयता 10.0 10.0
संगति 9.2 10.0
सही परीक्षण
प्रति प्रयास पास दर 63.6% 90.9%
अस्थिर टेस्ट 2 0
कुल रन 66 66
प्रति परिणाम लागत 8.969 6.801
कुल लागत $1.166 $1.361
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $12.000 / 1M
कुल इनपुट टोकन 149,206 92,287
आउटपुट टोकन 16,797 5,232
रीजनिंग टोकन 0 92,726
प्रतिक्रिया समय (औसत) 4.91s 21.47s
प्रतिक्रिया समय (अधिकतम) 35.03s 88.68s
प्रतिक्रिया समय (कुल) 108.03s 322.08s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Claude Opus 4.8

none
लागत
$0.053
समय
22.0s
टोकन
2,253 tok

#10 Gemini 3.1 Pro Preview

medium
लागत
$0.115
समय
87.2s
टोकन
9,629 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247

त्वरित तुलना

तुलना जोड़ी बदलें