नेविगेशन
Advertise here

Gemini 3.5 Flash (high) vs GPT-6.1 Sol (high)

GPT-6.1 Sol (high) average score में आगे है: 9.6 vs 9.4. GPT-6.1 Sol (high) की benchmark लागत कम है: $0.542 vs $2.011. GPT-6.1 Sol (high) तेज है: 13.68s vs 15.46s, pass rates 89.4% vs 93.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#17
कुल आउटपुट टोकन
205,482
प्रतिक्रिया समय (औसत)
15.46s
कुल लागत
$2.011
रैंक
#12
कुल आउटपुट टोकन
38,258
प्रतिक्रिया समय (औसत)
13.68s
कुल लागत
$0.542
अनुशंसित मॉडल GPT-6.1 Sol (high)

It has the best score here (9.6), while costing about 3.7x less than Gemini 3.5 Flash (high).

विस्तृत तुलना

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash high रिलीज़: 2026-05-19 GPT-6.1 Sol GPT-6.1 Sol high रिलीज़: 2026-09-29
स्कोर 9.4 9.6
रैंक #17 #12
विश्वसनीयता 10.0 10.0
संगति 9.3 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 89.4% 93.9%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 10.580 2.708
कुल लागत $2.011 $0.542
इनपुट कीमत $1.500 / 1M $2.000 / 1M
आउटपुट कीमत $9.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 107,146 79,492
आउटपुट टोकन 8,777 4,954
रीजनिंग टोकन 196,705 33,304
प्रतिक्रिया समय (औसत) 15.46s 13.68s
प्रतिक्रिया समय (अधिकतम) 145.92s 139.76s
प्रतिक्रिया समय (कुल) 340.20s 301.03s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#17 Gemini 3.5 Flash

high
लागत
$0.208
समय
118.2s
टोकन
23,158 tok

#12 GPT-6.1 Sol

high
लागत
$0.079
समय
149.5s
टोकन
7,920 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.96s 8,118 456 47,129
GPT-6.1 Sol 10.0 10.0 100.0% 0 5.18s 7,302 390 2,215

त्वरित तुलना

तुलना जोड़ी बदलें