नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: GPT-5.4

सारांश

Gemini 3.5 Flash vs GPT-5.4 benchmark तुलना: GPT-5.4 average score मध्ये पुढे आहे: 8.5 vs 7.0. Gemini 3.5 Flash चा benchmark खर्च कमी आहे: $1.079 vs $1.210. Gemini 3.5 Flash वेगवान आहे: 9.93s vs 22.35s, pass rates 77.8% vs 76.2%.

शिफारस केलेले मॉडेल: Gemini 3.5 Flash - It offers the best overall trade-off: a competitive score (7.0), lower cost than GPT-5.4, and balanced response time.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-12

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash none प्रकाशन: 2026-05-19 GPT-5.4 GPT-5.4 medium प्रकाशन: 2026-03-05
स्कोअर 7.0 8.5
क्रमांक #66 #20
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 77.8% 76.2%
अस्थिर चाचण्या 3 4
एकूण रन 63 63
प्रति निकाल खर्च 7.190 8.640
एकूण खर्च $1.079 $1.210
इनपुट किंमत $1.500 / 1M $2.500 / 1M
आउटपुट किंमत $9.000 / 1M $15.000 / 1M
एकूण इनपुट टोकन्स 13,843 34,108
आउटपुट टोकन्स 117,518 2,242
रिझनिंग टोकन्स 0 72,707
प्रतिसाद वेळ (सरासरी) 9.93s 22.35s
प्रतिसाद वेळ (कमाल) 64.36s 100.41s
प्रतिसाद वेळ (एकूण) 178.68s 469.29s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Gemini 3.5 Flash

none
Cost
$0.225
Time
125.5s
Tokens
25,004 tok

#20 GPT-5.4

medium
Cost
$0.214
Time
199.6s
Tokens
14,349 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.53s 492 5,101 0
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 8.8 7.8 88.9% 1 34.69s 8,122 75,927 0
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 6.5 10.0 50.0% 0 8.10s 2,781 5,895 0
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 7.6 7.2 77.8% 1 10.64s 633 17,910 0
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.46s 486 1,620 0
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 9.8 10.0 100.0% 0 3.38s 615 3,928 0
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.13s 558 4,640 0
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 2.8 1.6 33.3% 1 4.87s 156 2,497 0
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

झटपट तुलना

तुलना जोडी बदला