नेविगेशन
Advertise here

Gemini 3.1 Pro Preview (medium) vs GPT-6.1 Sol (low)

GPT-6.1 Sol (low) average score में आगे है: 9.5 vs 9.2. GPT-6.1 Sol (low) की benchmark लागत कम है: $0.275 vs $1.352. GPT-6.1 Sol (low) तेज है: 5.36s vs 20.62s, pass rates 90.9% vs 92.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#27
कुल आउटपुट टोकन
97,238
प्रतिक्रिया समय (औसत)
20.62s
कुल लागत
$1.352
रैंक
#16
कुल आउटपुट टोकन
11,879
प्रतिक्रिया समय (औसत)
5.36s
कुल लागत
$0.275
अनुशंसित मॉडल GPT-6.1 Sol (low)

It has the best score here (9.5), while costing about 4.9x less than Gemini 3.1 Pro Preview (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium रिलीज़: 2026-02-19 GPT-6.1 Sol GPT-6.1 Sol low रिलीज़: 2026-09-29
स्कोर 9.2 9.5
रैंक #27 #16
विश्वसनीयता 10.0 10.0
संगति 10.0 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 90.9% 92.4%
अस्थिर टेस्ट 0 1
कुल रन 66 66
प्रति परिणाम लागत 6.758 1.375
कुल लागत $1.352 $0.275
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $12.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 92,296 78,018
आउटपुट टोकन 5,232 4,160
रीजनिंग टोकन 92,006 7,719
प्रतिक्रिया समय (औसत) 20.62s 5.36s
प्रतिक्रिया समय (अधिकतम) 88.68s 29.38s
प्रतिक्रिया समय (कुल) 329.94s 117.89s
पैरामीटर ~1.2T कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#27 Gemini 3.1 Pro Preview

medium
लागत
$0.115
समय
87.2s
टोकन
9,629 tok

#16 GPT-6.1 Sol

low
लागत
$0.028
समय
44.6s
टोकन
2,881 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

त्वरित तुलना

तुलना जोड़ी बदलें