नेविगेशन
Advertise here

Gemini 3.5 Flash (high) vs GPT-6.1 Sol (medium)

GPT-6.1 Sol (medium) average score में आगे है: 9.6 vs 9.4. GPT-6.1 Sol (medium) की benchmark लागत कम है: $0.326 vs $2.011. GPT-6.1 Sol (medium) तेज है: 6.99s vs 15.46s, pass rates 89.4% vs 93.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#17
कुल आउटपुट टोकन
205,482
प्रतिक्रिया समय (औसत)
15.46s
कुल लागत
$2.011
रैंक
#11
कुल आउटपुट टोकन
16,852
प्रतिक्रिया समय (औसत)
6.99s
कुल लागत
$0.326
अनुशंसित मॉडल GPT-6.1 Sol (medium)

It has the best score here (9.6), while costing about 6.2x less than Gemini 3.5 Flash (high).

विस्तृत तुलना

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash high रिलीज़: 2026-05-19 GPT-6.1 Sol GPT-6.1 Sol medium रिलीज़: 2026-09-29
स्कोर 9.4 9.6
रैंक #17 #11
विश्वसनीयता 10.0 10.0
संगति 9.3 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 89.4% 93.9%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 10.580 1.627
कुल लागत $2.011 $0.326
इनपुट कीमत $1.500 / 1M $2.000 / 1M
आउटपुट कीमत $9.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 107,146 78,368
आउटपुट टोकन 8,777 4,354
रीजनिंग टोकन 196,705 12,498
प्रतिक्रिया समय (औसत) 15.46s 6.99s
प्रतिक्रिया समय (अधिकतम) 145.92s 50.74s
प्रतिक्रिया समय (कुल) 340.20s 153.75s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#17 Gemini 3.5 Flash

high
लागत
$0.208
समय
118.2s
टोकन
23,158 tok

#11 GPT-6.1 Sol

medium
लागत
$0.045
समय
72.7s
टोकन
4,581 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.96s 8,118 456 47,129
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.74s 7,302 393 1,710

त्वरित तुलना

तुलना जोड़ी बदलें