नेविगेशन
AI BENCHY
Advertise here

Gemini 3.8 Flash (high) vs GPT-5.6 Sol (medium)

Gemini 3.8 Flash (high) average score में आगे है: 9.9 vs 9.4. GPT-5.6 Sol (medium) की benchmark लागत कम है: $0.508 vs $1.595. GPT-5.6 Sol (medium) तेज है: 12.63s vs 37.19s, pass rates 98.5% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#2
कुल आउटपुट टोकन
408,188
प्रतिक्रिया समय (औसत)
37.19s
कुल लागत
$1.595
रैंक
#9
कुल आउटपुट टोकन
34,977
प्रतिक्रिया समय (औसत)
12.63s
कुल लागत
$0.508
अनुशंसित मॉडल GPT-5.6 Sol (medium)

Its score stays close to the best score here (9.4 vs 9.9), while costing about 3.1x less than Gemini 3.8 Flash (high).

विस्तृत तुलना

मेट्रिक Gemini 3.8 Flash Gemini 3.8 Flash high रिलीज़: 2026-09-02 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 9.9 9.4
रैंक #2 #9
विश्वसनीयता 10.0 10.0
संगति 9.6 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 98.5% 90.9%
अस्थिर टेस्ट 1 3
कुल रन 66 66
प्रति परिणाम लागत 7.592 8.025
कुल लागत $1.595 $0.508
इनपुट कीमत $0.750 / 1M $2.000 / 1M
आउटपुट कीमत $3.750 / 1M $10.000 / 1M
कुल इनपुट टोकन 84,593 79,006
आउटपुट टोकन 10,517 4,696
रीजनिंग टोकन 397,671 30,281
प्रतिक्रिया समय (औसत) 37.19s 12.63s
प्रतिक्रिया समय (अधिकतम) 177.08s 79.40s
प्रतिक्रिया समय (कुल) 818.19s 277.88s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3.8 Flash

high
लागत
$0.077
समय
129.1s
टोकन
20,373 tok

#9 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.8 Flash 10.0 10.0 100.0% 0 29.30s 8,118 462 50,196
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें