नेविगेशन
Advertise here

Gemini 3.1 Pro Preview (medium) vs GPT-6 Sol (high)

GPT-6 Sol (high) average score में आगे है: 9.9 vs 9.2. GPT-6 Sol (high) की benchmark लागत कम है: $0.684 vs $1.352. Gemini 3.1 Pro Preview (medium) तेज है: 20.62s vs 22.21s, pass rates 90.9% vs 95.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#22
कुल आउटपुट टोकन
97,238
प्रतिक्रिया समय (औसत)
20.62s
कुल लागत
$1.352
रैंक
#3
कुल आउटपुट टोकन
52,589
प्रतिक्रिया समय (औसत)
22.21s
कुल लागत
$0.684
अनुशंसित मॉडल GPT-6 Sol (high)

It has the best score here (9.9), while costing about 2.0x less than Gemini 3.1 Pro Preview (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium रिलीज़: 2026-02-19 GPT-6 Sol GPT-6 Sol high रिलीज़: 2026-09-23
स्कोर 9.2 9.9
रैंक #22 #3
विश्वसनीयता 10.0 10.0
संगति 10.0 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 90.9% 95.5%
अस्थिर टेस्ट 0 0
कुल रन 66 66
प्रति परिणाम लागत 6.758 3.256
कुल लागत $1.352 $0.684
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $12.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 92,296 78,900
आउटपुट टोकन 5,232 4,627
रीजनिंग टोकन 92,006 47,962
प्रतिक्रिया समय (औसत) 20.62s 22.21s
प्रतिक्रिया समय (अधिकतम) 88.68s 136.22s
प्रतिक्रिया समय (कुल) 329.94s 488.52s
पैरामीटर ~1.2T कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 Gemini 3.1 Pro Preview

medium
लागत
$0.115
समय
87.2s
टोकन
9,629 tok

#3 GPT-6 Sol

high
लागत
$0.076
समय
91.0s
टोकन
7,593 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-6 Sol 10.0 10.0 100.0% 0 19.12s 7,302 391 4,970

त्वरित तुलना

तुलना जोड़ी बदलें