नेविगेशन
AI BENCHY
Advertise here

Google: Gemini 3.5 Flash-Lite vs xAI: Grok 4.5

Grok 4.5 (medium) average score में आगे है: 8.3 vs 8.1. Gemini 3.5 Flash-Lite (high) की benchmark लागत कम है: $0.584 vs $1.928. Gemini 3.5 Flash-Lite (high) तेज है: 9.48s vs 61.71s, pass rates 81.8% vs 78.8%.

अनुशंसित मॉडलGemini 3.5 Flash-Lite (high)Its score stays close to the best score here (8.1 vs 8.3), while costing about 3.3x less than Grok 4.5 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high रिलीज़: 2026-07-21 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 8.1 8.3
रैंक #31 #25
विश्वसनीयता 10.0 10.0
संगति 7.5 8.9
सही परीक्षण
प्रति प्रयास पास दर 81.8% 78.8%
अस्थिर टेस्ट 7 3
कुल रन 66 66
प्रति परिणाम लागत 4.169 12.049
कुल लागत $0.584 $1.928
इनपुट कीमत $0.300 / 1M $2.000 / 1M
आउटपुट कीमत $2.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 105,138 122,146
आउटपुट टोकन 8,315 5,514
रीजनिंग टोकन 212,507 275,053
प्रतिक्रिया समय (औसत) 9.48s 61.71s
प्रतिक्रिया समय (अधिकतम) 43.93s 436.38s
प्रतिक्रिया समय (कुल) 208.52s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#31 Gemini 3.5 Flash-Lite

high
लागत
$0.023
समय
23.6s
टोकन
9,128 tok

#25 xAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें