नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Anthropic: Claude Sonnet 5 vs Google: Gemini 3 Flash Preview

सारांश

Claude Sonnet 5 vs Gemini 3 Flash Preview benchmark तुलना: Gemini 3 Flash Preview average score में आगे है: 9.6 vs 5.7. Claude Sonnet 5 की benchmark लागत कम है: $0.287 vs $0.667. Claude Sonnet 5 तेज है: 4.74s vs 18.64s, pass rates 42.9% vs 98.4%.

अनुशंसित मॉडल: Gemini 3 Flash Preview - It has the strongest score in this comparison (9.6) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-30

मेट्रिक Claude Sonnet 5 Claude Sonnet 5 none रिलीज़: 2026-06-30 Gemini 3 Flash Preview Gemini 3 Flash Preview medium रिलीज़: 2025-12-17
स्कोर 5.7 9.6
रैंक #117 #2
विश्वसनीयता 10.0 10.0
संगति 8.6 9.7
सही परीक्षण
प्रति प्रयास पास दर 42.9% 98.4%
अस्थिर टेस्ट 4 1
कुल रन 63 63
प्रति परिणाम लागत 4.098 3.335
कुल लागत $0.287 $0.667
इनपुट कीमत $2.000 / 1M $0.500 / 1M
आउटपुट कीमत $10.000 / 1M $3.000 / 1M
कुल इनपुट टोकन 76,797 37,017
आउटपुट टोकन 13,325 2,006
रीजनिंग टोकन 0 214,153
प्रतिक्रिया समय (औसत) 4.74s 18.64s
प्रतिक्रिया समय (अधिकतम) 29.46s 117.26s
प्रतिक्रिया समय (कुल) 99.46s 391.35s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#117 Claude Sonnet 5

none
लागत
$0.061
समय
53.7s
टोकन
6,172 tok

#2 Gemini 3 Flash Preview

medium
लागत
$0.010
समय
17.9s
टोकन
3,236 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 5.3 10.0 25.0% 0 3.60s 834 1,813 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.88s 494 330 3,216
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
Gemini 3 Flash Preview 8.6 7.6 88.9% 1 84.40s 8,122 462 161,084
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 3.0 10.0 0.0% 0 29.46s 38,775 6,340 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 22.42s 12,873 351 10,485
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 10.0 10.0 100.0% 0 3.01s 10,503 309 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.43s 7,548 279 4,893
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 5.3 7.2 44.4% 1 3.28s 975 933 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 15.27s 633 12 21,684
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 4.7 3.1 33.3% 1 2.81s 708 272 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.19s 486 72 1,905
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 6.4 10.0 50.0% 0 2.58s 909 103 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.04s 615 72 2,709
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 6.0 7.4 55.6% 1 3.22s 894 778 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.05s 558 183 4,365
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 10.0 10.0 100.0% 0 6.80s 12,351 522 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 12.60s 5,532 234 1,487
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 3.0 10.0 0.0% 0 4.31s 258 391 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.50s 156 11 2,325

त्वरित तुलना

तुलना जोड़ी बदलें