नेविगेशन
Advertise here

Gemini 3.1 Pro Preview (medium) vs GPT-5.5 (low)

GPT-5.5 (low) average score में आगे है: 9.3 vs 9.2. GPT-5.5 (low) की benchmark लागत कम है: $1.257 vs $1.352. GPT-5.5 (low) तेज है: 10.15s vs 20.62s, pass rates 90.9% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-07

तुलना किए गए मॉडल

रैंक
#18
कुल आउटपुट टोकन
97,238
प्रतिक्रिया समय (औसत)
20.62s
कुल लागत
$1.352
रैंक
#16
कुल आउटपुट टोकन
28,540
प्रतिक्रिया समय (औसत)
10.15s
कुल लागत
$1.257
अनुशंसित मॉडल GPT-5.5 (low)

It has the best score here (9.3), while responding about 2.0x faster than Gemini 3.1 Pro Preview (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium रिलीज़: 2026-02-19 GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24
स्कोर 9.2 9.3
रैंक #18 #16
विश्वसनीयता 10.0 10.0
संगति 10.0 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 90.9% 86.4%
अस्थिर टेस्ट 0 0
कुल रन 66 66
प्रति परिणाम लागत 6.758 6.614
कुल लागत $1.352 $1.257
इनपुट कीमत $2.000 / 1M $5.000 / 1M
आउटपुट कीमत $12.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 92,296 80,067
आउटपुट टोकन 5,232 5,378
रीजनिंग टोकन 92,006 23,162
प्रतिक्रिया समय (औसत) 20.62s 10.15s
प्रतिक्रिया समय (अधिकतम) 88.68s 56.19s
प्रतिक्रिया समय (कुल) 329.94s 223.24s
पैरामीटर ~1.2T कुल (~20B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 Gemini 3.1 Pro Preview

medium
लागत
$0.115
समय
87.2s
टोकन
9,629 tok

#16 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

त्वरित तुलना

तुलना जोड़ी बदलें