नेविगेशन
AI BENCHY
Advertise here

Gemini 3.1 Pro Preview (medium) vs GPT-5.6 Sol (low)

GPT-5.6 Sol (low) average score में आगे है: 9.5 vs 9.2. GPT-5.6 Sol (low) की benchmark लागत कम है: $0.496 vs $1.352. GPT-5.6 Sol (low) तेज है: 9.04s vs 20.62s, pass rates 90.9% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#12
कुल आउटपुट टोकन
97,238
प्रतिक्रिया समय (औसत)
20.62s
कुल लागत
$1.352
रैंक
#4
कुल आउटपुट टोकन
19,946
प्रतिक्रिया समय (औसत)
9.04s
कुल लागत
$0.496
अनुशंसित मॉडल GPT-5.6 Sol (low)

It has the best score here (9.5), while costing about 2.7x less than Gemini 3.1 Pro Preview (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium रिलीज़: 2026-02-19 GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09
स्कोर 9.2 9.5
रैंक #12 #4
विश्वसनीयता 10.0 10.0
संगति 10.0 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 90.9% 86.4%
अस्थिर टेस्ट 0 2
कुल रन 66 66
प्रति परिणाम लागत 6.758 5.508
कुल लागत $1.352 $0.496
इनपुट कीमत $2.000 / 1M $2.500 / 1M
आउटपुट कीमत $12.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 92,296 78,580
आउटपुट टोकन 5,232 4,476
रीजनिंग टोकन 92,006 15,470
प्रतिक्रिया समय (औसत) 20.62s 9.04s
प्रतिक्रिया समय (अधिकतम) 88.68s 53.91s
प्रतिक्रिया समय (कुल) 329.94s 198.97s
पैरामीटर ~1.2T कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Gemini 3.1 Pro Preview

medium
लागत
$0.115
समय
87.2s
टोकन
9,629 tok

#4 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

त्वरित तुलना

तुलना जोड़ी बदलें