नेविगेशन
AI BENCHY
Advertise here

Gemini 3.8 Flash (high) vs GPT-5.5 (low)

Gemini 3.8 Flash (high) average score में आगे है: 9.9 vs 9.3. GPT-5.5 (low) की benchmark लागत कम है: $1.257 vs $1.595. GPT-5.5 (low) तेज है: 10.15s vs 37.19s, pass rates 98.5% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#2
कुल आउटपुट टोकन
408,188
प्रतिक्रिया समय (औसत)
37.19s
कुल लागत
$1.595
रैंक
#11
कुल आउटपुट टोकन
28,540
प्रतिक्रिया समय (औसत)
10.15s
कुल लागत
$1.257
अनुशंसित मॉडल GPT-5.5 (low)

Its score stays close to the best score here (9.3 vs 9.9), while responding about 3.7x faster than Gemini 3.8 Flash (high).

विस्तृत तुलना

मेट्रिक Gemini 3.8 Flash Gemini 3.8 Flash high रिलीज़: 2026-09-02 GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24
स्कोर 9.9 9.3
रैंक #2 #11
विश्वसनीयता 10.0 10.0
संगति 9.6 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 98.5% 86.4%
अस्थिर टेस्ट 1 0
कुल रन 66 66
प्रति परिणाम लागत 7.592 6.614
कुल लागत $1.595 $1.257
इनपुट कीमत $0.750 / 1M $5.000 / 1M
आउटपुट कीमत $3.750 / 1M $30.000 / 1M
कुल इनपुट टोकन 84,593 80,067
आउटपुट टोकन 10,517 5,378
रीजनिंग टोकन 397,671 23,162
प्रतिक्रिया समय (औसत) 37.19s 10.15s
प्रतिक्रिया समय (अधिकतम) 177.08s 56.19s
प्रतिक्रिया समय (कुल) 818.19s 223.24s
पैरामीटर ~500B कुल (~20B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3.8 Flash

high
लागत
$0.077
समय
129.1s
टोकन
20,373 tok

#11 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.8 Flash 10.0 10.0 100.0% 0 29.30s 8,118 462 50,196
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

त्वरित तुलना

तुलना जोड़ी बदलें