नेविगेशन
AI BENCHY
Advertise here

Gemini 3.7 Flash (low) vs GPT-5.6 Sol (medium)

GPT-5.6 Sol (medium) average score में आगे है: 9.4 vs 9.2. Gemini 3.7 Flash (low) की benchmark लागत कम है: $0.106 vs $1.316. Gemini 3.7 Flash (low) तेज है: 3.96s vs 11.35s, pass rates 92.4% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-14

रैंक
#15
कुल आउटपुट टोकन
38,104
प्रतिक्रिया समय (औसत)
3.96s
कुल लागत
$0.106
रैंक
#8
कुल आउटपुट टोकन
30,698
प्रतिक्रिया समय (औसत)
11.35s
कुल लागत
$1.316
अनुशंसित मॉडल Gemini 3.7 Flash (low)

Its score stays close to the best score here (9.2 vs 9.4), while costing about 12.5x less than GPT-5.6 Sol (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.7 Flash Gemini 3.7 Flash low रिलीज़: 2026-08-14 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 9.2 9.4
रैंक #15 #8
विश्वसनीयता 10.0 10.0
संगति 9.6 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 92.4% 90.9%
अस्थिर टेस्ट 1 3
कुल रन 66 66
प्रति परिणाम लागत 0.527 7.311
कुल लागत $0.106 $1.316
इनपुट कीमत $0.375 / 1M $5.000 / 1M
आउटपुट कीमत $1.875 / 1M $30.000 / 1M
कुल इनपुट टोकन 90,313 78,997
आउटपुट टोकन 6,294 4,696
रीजनिंग टोकन 31,810 26,002
प्रतिक्रिया समय (औसत) 3.96s 11.35s
प्रतिक्रिया समय (अधिकतम) 19.44s 79.40s
प्रतिक्रिया समय (कुल) 87.08s 249.73s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#15 Gemini 3.7 Flash

low
लागत
$0.010
समय
23.5s
टोकन
5,210 tok

#8 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.7 Flash 7.6 7.2 77.8% 1 6.20s 8,118 461 11,508
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें