नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.5 Flash-Lite vs OpenAI: GPT-5.4

GPT-5.4 (medium) average score में आगे है: 8.5 vs 8.1. Gemini 3.5 Flash-Lite (high) की benchmark लागत कम है: $0.584 vs $1.533. Gemini 3.5 Flash-Lite (high) तेज है: 9.48s vs 23.10s, pass rates 81.8% vs 77.3%.

अनुशंसित मॉडलGemini 3.5 Flash-Lite (high)Its score stays close to the best score here (8.1 vs 8.5), while costing about 2.6x less than GPT-5.4 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high रिलीज़: 2026-07-21 GPT-5.4 GPT-5.4 medium रिलीज़: 2026-03-05
स्कोर 8.1 8.5
रैंक #31 #21
विश्वसनीयता 10.0 10.0
संगति 7.5 8.6
सही परीक्षण
प्रति प्रयास पास दर 81.8% 77.3%
अस्थिर टेस्ट 7 4
कुल रन 66 66
प्रति परिणाम लागत 4.169 10.220
कुल लागत $0.584 $1.533
इनपुट कीमत $0.300 / 1M $2.500 / 1M
आउटपुट कीमत $2.500 / 1M $15.000 / 1M
कुल इनपुट टोकन 105,138 81,127
आउटपुट टोकन 8,315 6,155
रीजनिंग टोकन 212,507 82,515
प्रतिक्रिया समय (औसत) 9.48s 23.10s
प्रतिक्रिया समय (अधिकतम) 43.93s 100.41s
प्रतिक्रिया समय (कुल) 208.52s 508.26s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#31 Gemini 3.5 Flash-Lite

high
लागत
$0.023
समय
23.6s
टोकन
9,128 tok

#21 GPT-5.4

medium
लागत
$0.214
समय
199.6s
टोकन
14,349 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216

त्वरित तुलना

तुलना जोड़ी बदलें