नेव्हिगेशन
AI BENCHY
Advertise here

Google: Gemini 3.5 Flash-Lite vs xAI: Grok 4.5

Grok 4.5 (medium) average score मध्ये पुढे आहे: 8.3 vs 8.1. Gemini 3.5 Flash-Lite (high) चा benchmark खर्च कमी आहे: $0.584 vs $1.928. Gemini 3.5 Flash-Lite (high) वेगवान आहे: 9.48s vs 61.71s, pass rates 81.8% vs 78.8%.

शिफारस केलेले मॉडेलGemini 3.5 Flash-Lite (high)Its score stays close to the best score here (8.1 vs 8.3), while costing about 3.3x less than Grok 4.5 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-22

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high प्रकाशन: 2026-07-21 Grok 4.5 Grok 4.5 medium प्रकाशन: 2026-07-08
स्कोअर 8.1 8.3
क्रमांक #31 #25
विश्वसनीयता 10.0 10.0
सुसंगतता 7.5 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 81.8% 78.8%
अस्थिर चाचण्या 7 3
एकूण रन 66 66
प्रति निकाल खर्च 4.169 12.049
एकूण खर्च $0.584 $1.928
इनपुट किंमत $0.300 / 1M $2.000 / 1M
आउटपुट किंमत $2.500 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 105,138 122,146
आउटपुट टोकन्स 8,315 5,514
रिझनिंग टोकन्स 212,507 275,053
प्रतिसाद वेळ (सरासरी) 9.48s 61.71s
प्रतिसाद वेळ (कमाल) 43.93s 436.38s
प्रतिसाद वेळ (एकूण) 208.52s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#31 Gemini 3.5 Flash-Lite

high
खर्च
$0.023
वेळ
23.6s
टोकन्स
9,128 tok

#25 xAI: Grok 4.5

medium
खर्च
$0.044
वेळ
59.4s
टोकन्स
7,512 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

झटपट तुलना

तुलना जोडी बदला