नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 2.5 Flash vs OpenAI: GPT-5.4

सारांश

Gemini 2.5 Flash vs GPT-5.4 benchmark तुलना: Gemini 2.5 Flash average score मध्ये पुढे आहे: 6.2 vs 5.8. Gemini 2.5 Flash चा benchmark खर्च कमी आहे: $0.016 vs $0.122. Gemini 2.5 Flash वेगवान आहे: 875ms vs 1.42s, pass rates 46.0% vs 36.5%.

शिफारस केलेले मॉडेल: Gemini 2.5 Flash - It has the best score here (6.2), while costing about 8.0x less than GPT-5.4.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-18

मेट्रिक Gemini 2.5 Flash Gemini 2.5 Flash none प्रकाशन: 2025-06-17 GPT-5.4 GPT-5.4 none प्रकाशन: 2026-03-05
स्कोअर 6.2 5.8
क्रमांक #93 #112
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 46.0% 36.5%
अस्थिर चाचण्या 1 2
एकूण रन 63 63
प्रति निकाल खर्च 0.169 1.740
एकूण खर्च $0.016 $0.122
इनपुट किंमत $0.300 / 1M $2.500 / 1M
आउटपुट किंमत $2.500 / 1M $15.000 / 1M
एकूण इनपुट टोकन्स 35,926 34,212
आउटपुट टोकन्स 1,770 2,417
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 875ms 1.42s
प्रतिसाद वेळ (कमाल) 4.39s 2.95s
प्रतिसाद वेळ (एकूण) 18.37s 29.87s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 Gemini 2.5 Flash

none
अवैध SVG
खर्च
$0.164
वेळ
215.5s
टोकन्स
65,659 tok

#112 GPT-5.4

none
खर्च
$0.026
वेळ
18.1s
टोकन्स
1,792 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 2.5 Flash 3.0 10.0 0.0% 0 582ms 492 102 0
GPT-5.4 3.2 8.0 8.3% 1 1.21s 606 406 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 2.5 Flash 5.5 10.0 33.3% 0 736ms 8,122 483 0
GPT-5.4 5.5 10.0 33.3% 0 1.62s 7,305 516 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 2.5 Flash 3.0 10.0 0.0% 0 4.39s 12,519 366 0
GPT-5.4 3.0 10.0 0.0% 0 2.89s 11,019 291 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 2.5 Flash 10.0 10.0 100.0% 0 652ms 7,257 279 0
GPT-5.4 10.0 10.0 100.0% 0 1.04s 7,140 222 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 2.5 Flash 5.9 7.2 55.6% 1 495ms 633 12 0
GPT-5.4 5.3 7.2 44.4% 1 1.07s 723 50 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 2.5 Flash 5.0 10.0 0.0% 0 615ms 486 78 0
GPT-5.4 4.4 9.9 0.0% 0 1.78s 477 184 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 2.5 Flash 10.0 10.0 100.0% 0 590ms 615 72 0
GPT-5.4 6.5 10.0 50.0% 0 1.07s 660 81 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 2.5 Flash 7.7 10.0 66.7% 0 604ms 558 132 0
GPT-5.4 5.6 9.8 33.3% 0 1.44s 642 381 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 2.5 Flash 10.0 10.0 100.0% 0 1.91s 5,088 234 0
GPT-5.4 10.0 10.0 100.0% 0 2.75s 5,445 246 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 2.5 Flash 3.0 10.0 0.0% 0 1.15s 156 12 0
GPT-5.4 3.0 10.0 0.0% 0 990ms 195 40 0

झटपट तुलना

तुलना जोडी बदला