नेविगेशन
Advertise here

Gemini 3.7 Flash (low) vs GPT-6.1 Sol (high)

GPT-6.1 Sol (high) average score में आगे है: 9.6 vs 9.2. Gemini 3.7 Flash (low) की benchmark लागत कम है: $0.207 vs $0.542. Gemini 3.7 Flash (low) तेज है: 3.85s vs 13.68s, pass rates 95.5% vs 93.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#28
कुल आउटपुट टोकन
37,053
प्रतिक्रिया समय (औसत)
3.85s
कुल लागत
$0.207
रैंक
#12
कुल आउटपुट टोकन
38,258
प्रतिक्रिया समय (औसत)
13.68s
कुल लागत
$0.542
अनुशंसित मॉडल Gemini 3.7 Flash (low)

Its score stays close to the best score here (9.2 vs 9.6), while costing about 2.6x less than GPT-6.1 Sol (high).

विस्तृत तुलना

मेट्रिक Gemini 3.7 Flash Gemini 3.7 Flash low रिलीज़: 2026-08-14 GPT-6.1 Sol GPT-6.1 Sol high रिलीज़: 2026-09-29
स्कोर 9.2 9.6
रैंक #28 #12
विश्वसनीयता 10.0 10.0
संगति 9.2 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 95.5% 93.9%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 0.517 2.708
कुल लागत $0.207 $0.542
इनपुट कीमत $0.750 / 1M $2.000 / 1M
आउटपुट कीमत $3.750 / 1M $10.000 / 1M
कुल इनपुट टोकन 90,322 79,492
आउटपुट टोकन 6,294 4,954
रीजनिंग टोकन 30,759 33,304
प्रतिक्रिया समय (औसत) 3.85s 13.68s
प्रतिक्रिया समय (अधिकतम) 19.44s 139.76s
प्रतिक्रिया समय (कुल) 84.80s 301.03s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#28 Gemini 3.7 Flash

low
लागत
$0.010
समय
23.5s
टोकन
5,210 tok

#12 GPT-6.1 Sol

high
लागत
$0.079
समय
149.5s
टोकन
7,920 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.7 Flash 7.6 7.2 77.8% 1 6.20s 8,118 461 11,508
GPT-6.1 Sol 10.0 10.0 100.0% 0 5.18s 7,302 390 2,215

त्वरित तुलना

तुलना जोड़ी बदलें