नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Anthropic: Claude Sonnet 5 vs Google: Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite (medium) average score में आगे है: 6.5 vs 6.3. Gemini 3.5 Flash-Lite (medium) की benchmark लागत कम है: $0.369 vs $0.548. Gemini 3.5 Flash-Lite (medium) तेज है: 6.01s vs 6.04s, pass rates 45.5% vs 69.7%.

अनुशंसित मॉडलGemini 3.5 Flash-Lite (medium)It has the strongest score in this comparison (6.5) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक Claude Sonnet 5 Claude Sonnet 5 none रिलीज़: 2026-06-30 Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite medium रिलीज़: 2026-07-21
स्कोर 6.3 6.5
रैंक #118 #104
विश्वसनीयता 10.0 10.0
संगति 8.7 7.4
सही परीक्षण
प्रति प्रयास पास दर 45.5% 69.7%
अस्थिर टेस्ट 4 7
कुल रन 66 66
प्रति परिणाम लागत 6.840 3.074
कुल लागत $0.548 $0.369
इनपुट कीमत $2.000 / 1M $0.300 / 1M
आउटपुट कीमत $10.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 161,035 118,818
आउटपुट टोकन 22,511 11,677
रीजनिंग टोकन 0 121,611
प्रतिक्रिया समय (औसत) 6.04s 6.01s
प्रतिक्रिया समय (अधिकतम) 33.39s 49.03s
प्रतिक्रिया समय (कुल) 132.85s 132.30s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 Claude Sonnet 5

none
लागत
$0.061
समय
53.7s
टोकन
6,172 tok

#104 Gemini 3.5 Flash-Lite

medium
लागत
$0.015
समय
16.4s
टोकन
5,971 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
Gemini 3.5 Flash-Lite 5.5 7.4 44.4% 1 8.37s 8,136 452 25,999

त्वरित तुलना

तुलना जोड़ी बदलें