नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Anthropic: Claude Sonnet 4.6 vs Google: Gemini 3.5 Flash

सारांश

Claude Sonnet 4.6 vs Gemini 3.5 Flash benchmark तुलना: Claude Sonnet 4.6 average score में आगे है: 7.8 vs 7.0. Gemini 3.5 Flash की benchmark लागत कम है: $1.079 vs $1.418. Gemini 3.5 Flash तेज है: 9.93s vs 17.06s, pass rates 65.1% vs 77.8%.

अनुशंसित मॉडल: Claude Sonnet 4.6 - It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 medium रिलीज़: 2026-02-17 Gemini 3.5 Flash Gemini 3.5 Flash none रिलीज़: 2026-05-19
स्कोर 7.8 7.0
रैंक #32 #69
विश्वसनीयता 10.0 10.0
संगति 9.1 8.9
सही परीक्षण
प्रति प्रयास पास दर 65.1% 77.8%
अस्थिर टेस्ट 2 3
कुल रन 63 63
प्रति परिणाम लागत 10.904 7.190
कुल लागत $1.418 $1.079
इनपुट कीमत $3.000 / 1M $1.500 / 1M
आउटपुट कीमत $15.000 / 1M $9.000 / 1M
कुल इनपुट टोकन 49,112 13,843
आउटपुट टोकन 54,703 117,518
रीजनिंग टोकन 29,970 0
प्रतिक्रिया समय (औसत) 17.06s 9.93s
प्रतिक्रिया समय (अधिकतम) 46.35s 64.36s
प्रतिक्रिया समय (कुल) 221.83s 178.68s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 Claude Sonnet 4.6

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

#69 Gemini 3.5 Flash

none
लागत
$0.225
समय
125.5s
टोकन
25,004 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 789 1,046 1,093
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.53s 492 5,101 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686
Gemini 3.5 Flash 8.8 7.8 88.9% 1 34.69s 8,122 75,927 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 18,351 5,871 3,962
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 8,676 649 742
Gemini 3.5 Flash 6.5 10.0 50.0% 0 8.10s 2,781 5,895 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 471 25,790 16,919
Gemini 3.5 Flash 7.6 7.2 77.8% 1 10.64s 633 17,910 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 564 256 433
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.46s 486 1,620 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 792 318 552
Gemini 3.5 Flash 9.8 10.0 100.0% 0 3.38s 615 3,928 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 5.31s 816 592 646
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.13s 558 4,640 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 11,454 655 351
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 3.0 10.0 0.0% 0 30.09s 204 3,437 1,586
Gemini 3.5 Flash 2.8 1.6 33.3% 1 4.87s 156 2,497 0

त्वरित तुलना

तुलना जोड़ी बदलें