नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.5 Flash-Lite vs xAI: Grok 4.5

Grok 4.5 (low) average score मध्ये पुढे आहे: 8.4 vs 8.1. Gemini 3.5 Flash-Lite (high) चा benchmark खर्च कमी आहे: $0.584 vs $0.935. Gemini 3.5 Flash-Lite (high) वेगवान आहे: 9.48s vs 15.56s, pass rates 81.8% vs 75.8%.

शिफारस केलेले मॉडेलGemini 3.5 Flash-Lite (high)Its score stays close to the best score here (8.1 vs 8.4), while costing about 1.6x less than Grok 4.5 (low).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high प्रकाशन: 2026-07-21 Grok 4.5 Grok 4.5 low प्रकाशन: 2026-07-08
स्कोअर 8.1 8.4
क्रमांक #31 #23
विश्वसनीयता 10.0 10.0
सुसंगतता 7.5 9.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 81.8% 75.8%
अस्थिर चाचण्या 7 1
एकूण रन 66 66
प्रति निकाल खर्च 4.169 5.844
एकूण खर्च $0.584 $0.935
इनपुट किंमत $0.300 / 1M $2.000 / 1M
आउटपुट किंमत $2.500 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 105,138 125,596
आउटपुट टोकन्स 8,315 7,505
रिझनिंग टोकन्स 212,507 106,446
प्रतिसाद वेळ (सरासरी) 9.48s 15.56s
प्रतिसाद वेळ (कमाल) 43.93s 205.28s
प्रतिसाद वेळ (एकूण) 208.52s 342.32s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#31 Gemini 3.5 Flash-Lite

high
खर्च
$0.023
वेळ
23.6s
टोकन्स
9,128 tok

#23 xAI: Grok 4.5

low
खर्च
$0.011
वेळ
12.4s
टोकन्स
2,018 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

झटपट तुलना

तुलना जोडी बदला