नेव्हिगेशन
AI BENCHY
Advertise here

Anthropic: Claude Sonnet 5 vs Google: Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite (medium) average score मध्ये पुढे आहे: 6.5 vs 6.3. Gemini 3.5 Flash-Lite (medium) चा benchmark खर्च कमी आहे: $0.369 vs $0.548. Gemini 3.5 Flash-Lite (medium) वेगवान आहे: 6.01s vs 6.04s, pass rates 45.5% vs 69.7%.

शिफारस केलेले मॉडेलGemini 3.5 Flash-Lite (medium)It has the strongest score in this comparison (6.5) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक Claude Sonnet 5 Claude Sonnet 5 none प्रकाशन: 2026-06-30 Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite medium प्रकाशन: 2026-07-21
स्कोअर 6.3 6.5
क्रमांक #118 #104
विश्वसनीयता 10.0 10.0
सुसंगतता 8.7 7.4
बरोबर चाचण्या
प्रति प्रयत्न पास दर 45.5% 69.7%
अस्थिर चाचण्या 4 7
एकूण रन 66 66
प्रति निकाल खर्च 6.840 3.074
एकूण खर्च $0.548 $0.369
इनपुट किंमत $2.000 / 1M $0.300 / 1M
आउटपुट किंमत $10.000 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 161,035 118,818
आउटपुट टोकन्स 22,511 11,677
रिझनिंग टोकन्स 0 121,611
प्रतिसाद वेळ (सरासरी) 6.04s 6.01s
प्रतिसाद वेळ (कमाल) 33.39s 49.03s
प्रतिसाद वेळ (एकूण) 132.85s 132.30s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 Claude Sonnet 5

none
खर्च
$0.061
वेळ
53.7s
टोकन्स
6,172 tok

#104 Gemini 3.5 Flash-Lite

medium
खर्च
$0.015
वेळ
16.4s
टोकन्स
5,971 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
Gemini 3.5 Flash-Lite 5.5 7.4 44.4% 1 8.37s 8,136 452 25,999

झटपट तुलना

तुलना जोडी बदला