नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.1 Pro Preview vs OpenAI: GPT-5.5

GPT-5.5 (low) average score में आगे है: 9.3 vs 9.2. GPT-5.5 (low) की benchmark लागत कम है: $1.253 vs $1.361. GPT-5.5 (low) तेज है: 10.13s vs 21.47s, pass rates 90.9% vs 86.4%.

अनुशंसित मॉडलGPT-5.5 (low)It has the best score here (9.3), while responding about 2.1x faster than Gemini 3.1 Pro Preview (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium रिलीज़: 2026-02-19 GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24
स्कोर 9.2 9.3
रैंक #10 #9
विश्वसनीयता 10.0 10.0
संगति 10.0 10.0
सही परीक्षण
प्रति प्रयास पास दर 90.9% 86.4%
अस्थिर टेस्ट 0 0
कुल रन 66 66
प्रति परिणाम लागत 6.801 6.594
कुल लागत $1.361 $1.253
इनपुट कीमत $2.000 / 1M $5.000 / 1M
आउटपुट कीमत $12.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 92,287 80,058
आउटपुट टोकन 5,232 5,378
रीजनिंग टोकन 92,726 23,040
प्रतिक्रिया समय (औसत) 21.47s 10.13s
प्रतिक्रिया समय (अधिकतम) 88.68s 56.19s
प्रतिक्रिया समय (कुल) 322.08s 222.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 Gemini 3.1 Pro Preview

medium
लागत
$0.115
समय
87.2s
टोकन
9,629 tok

#9 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

त्वरित तुलना

तुलना जोड़ी बदलें