नेविगेशन
AI BENCHY
Advertise here

Gemini 3.8 Flash (low) vs GPT 5.3 Chat

average score लगभग बराबर है: 7.5 vs 7.5. Gemini 3.8 Flash (low) की benchmark लागत कम है: $0.239 vs $0.533. Gemini 3.8 Flash (low) तेज है: 4.83s vs 6.56s, pass rates 81.8% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#99
कुल आउटपुट टोकन
41,324
प्रतिक्रिया समय (औसत)
4.83s
कुल लागत
$0.239
रैंक
#93
कुल आउटपुट टोकन
28,179
प्रतिक्रिया समय (औसत)
6.56s
कुल लागत
$0.533
अनुशंसित मॉडल Gemini 3.8 Flash (low)

It has the best score here (7.5), while costing about 2.2x less than GPT 5.3 Chat.

विस्तृत तुलना

मेट्रिक Gemini 3.8 Flash Gemini 3.8 Flash low रिलीज़: 2026-09-02 GPT 5.3 Chat GPT 5.3 Chat none रिलीज़: 2026-03-03
स्कोर 7.5 7.5
रैंक #99 #93
विश्वसनीयता 10.0 10.0
संगति 8.5 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 81.8% 65.2%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 1.493 4.097
कुल लागत $0.239 $0.533
इनपुट कीमत $0.750 / 1M $1.750 / 1M
आउटपुट कीमत $3.750 / 1M $14.000 / 1M
कुल इनपुट टोकन 111,773 78,846
आउटपुट टोकन 8,035 28,179
रीजनिंग टोकन 33,289 0
प्रतिक्रिया समय (औसत) 4.83s 6.56s
प्रतिक्रिया समय (अधिकतम) 35.14s 18.33s
प्रतिक्रिया समय (कुल) 106.18s 137.77s
पैरामीटर ~500B कुल (~20B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#99 Gemini 3.8 Flash

low
लागत
$0.030
समय
45.8s
टोकन
8,023 tok

#93 GPT 5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.8 Flash 5.4 7.2 44.4% 1 4.31s 8,118 449 5,706
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

त्वरित तुलना

तुलना जोड़ी बदलें