नेविगेशन
Advertise here

Gemini 3.7 Flash (low) vs GPT-6 Sol (medium)

GPT-6 Sol (medium) average score में आगे है: 9.4 vs 9.2. Gemini 3.7 Flash (low) की benchmark लागत कम है: $0.207 vs $0.448. Gemini 3.7 Flash (low) तेज है: 3.85s vs 10.33s, pass rates 95.5% vs 93.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#23
कुल आउटपुट टोकन
37,053
प्रतिक्रिया समय (औसत)
3.85s
कुल लागत
$0.207
रैंक
#14
कुल आउटपुट टोकन
29,115
प्रतिक्रिया समय (औसत)
10.33s
कुल लागत
$0.448
अनुशंसित मॉडल Gemini 3.7 Flash (low)

Its score stays close to the best score here (9.2 vs 9.4), while costing about 2.2x less than GPT-6 Sol (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.7 Flash Gemini 3.7 Flash low रिलीज़: 2026-08-14 GPT-6 Sol GPT-6 Sol medium रिलीज़: 2026-09-23
स्कोर 9.2 9.4
रैंक #23 #14
विश्वसनीयता 10.0 10.0
संगति 9.2 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 95.5% 93.9%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 0.517 2.240
कुल लागत $0.207 $0.448
इनपुट कीमत $0.750 / 1M $2.000 / 1M
आउटपुट कीमत $3.750 / 1M $10.000 / 1M
कुल इनपुट टोकन 90,322 78,376
आउटपुट टोकन 6,294 4,309
रीजनिंग टोकन 30,759 24,806
प्रतिक्रिया समय (औसत) 3.85s 10.33s
प्रतिक्रिया समय (अधिकतम) 19.44s 82.74s
प्रतिक्रिया समय (कुल) 84.80s 227.17s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#23 Gemini 3.7 Flash

low
लागत
$0.010
समय
23.5s
टोकन
5,210 tok

#14 GPT-6 Sol

medium
लागत
$0.035
समय
36.9s
टोकन
3,493 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.7 Flash 7.6 7.2 77.8% 1 6.20s 8,118 461 11,508
GPT-6 Sol 8.2 7.2 88.9% 1 11.78s 7,302 392 2,532

त्वरित तुलना

तुलना जोड़ी बदलें