नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Google: Gemini 3 Flash Preview vs OpenAI: GPT-5.4 Mini

सारांश

Gemini 3 Flash Preview vs GPT-5.4 Mini benchmark तुलना: Gemini 3 Flash Preview average score में आगे है: 9.6 vs 8.0. GPT-5.4 Mini की benchmark लागत कम है: $0.526 vs $0.667. Gemini 3 Flash Preview तेज है: 18.64s vs 22.34s, pass rates 98.4% vs 73.0%.

अनुशंसित मॉडल: Gemini 3 Flash Preview - It has the strongest score in this comparison (9.6) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-12

मेट्रिक Gemini 3 Flash Preview Gemini 3 Flash Preview medium रिलीज़: 2025-12-17 GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17
स्कोर 9.6 8.0
रैंक #2 #30
विश्वसनीयता 10.0 10.0
संगति 9.7 8.0
सही परीक्षण
प्रति प्रयास पास दर 98.4% 73.0%
अस्थिर टेस्ट 1 5
कुल रन 63 63
प्रति परिणाम लागत 3.335 4.381
कुल लागत $0.667 $0.526
इनपुट कीमत $0.500 / 1M $0.750 / 1M
आउटपुट कीमत $3.000 / 1M $4.500 / 1M
कुल इनपुट टोकन 37,017 34,116
आउटपुट टोकन 2,006 2,181
रीजनिंग टोकन 214,153 108,937
प्रतिक्रिया समय (औसत) 18.64s 22.34s
प्रतिक्रिया समय (अधिकतम) 117.26s 138.75s
प्रतिक्रिया समय (कुल) 391.35s 469.20s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3 Flash Preview

medium
Cost
$0.010
Time
17.9s
Tokens
3,236 tok

#30 GPT-5.4 Mini

medium
Cost
$0.056
Time
95.5s
Tokens
12,464 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.88s 494 330 3,216
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 606 296 2,876
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 8.6 7.6 88.9% 1 84.40s 8,122 462 161,084
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 22.42s 12,873 351 10,485
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 11,019 317 4,317
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.43s 7,548 279 4,893
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 7,140 234 650
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 15.27s 633 12 21,684
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 619 60 43,286
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.19s 486 72 1,905
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 477 150 510
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.04s 615 72 2,709
GPT-5.4 Mini 9.8 10.0 100.0% 0 2.13s 660 96 1,185
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.05s 558 183 4,365
GPT-5.4 Mini 7.8 10.0 66.7% 0 4.37s 642 278 2,443
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 12.60s 5,532 234 1,487
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 5,453 251 2,594
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.50s 156 11 2,325
GPT-5.4 Mini 3.0 10.0 0.0% 0 30.10s 195 32 10,174

त्वरित तुलना

तुलना जोड़ी बदलें