नेविगेशन
AI BENCHY
Advertise here

Gemini 3.8 Flash (high) vs GPT-5.6 Sol (low)

Gemini 3.8 Flash (high) average score में आगे है: 9.9 vs 9.5. GPT-5.6 Sol (low) की benchmark लागत कम है: $0.357 vs $1.595. GPT-5.6 Sol (low) तेज है: 9.04s vs 37.19s, pass rates 98.5% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#2
कुल आउटपुट टोकन
408,188
प्रतिक्रिया समय (औसत)
37.19s
कुल लागत
$1.595
रैंक
#5
कुल आउटपुट टोकन
19,946
प्रतिक्रिया समय (औसत)
9.04s
कुल लागत
$0.357
अनुशंसित मॉडल GPT-5.6 Sol (low)

Its score stays close to the best score here (9.5 vs 9.9), while costing about 4.5x less than Gemini 3.8 Flash (high).

विस्तृत तुलना

मेट्रिक Gemini 3.8 Flash Gemini 3.8 Flash high रिलीज़: 2026-09-02 GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09
स्कोर 9.9 9.5
रैंक #2 #5
विश्वसनीयता 10.0 10.0
संगति 9.6 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 98.5% 86.4%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 7.592 5.508
कुल लागत $1.595 $0.357
इनपुट कीमत $0.750 / 1M $2.000 / 1M
आउटपुट कीमत $3.750 / 1M $10.000 / 1M
कुल इनपुट टोकन 84,593 78,580
आउटपुट टोकन 10,517 4,476
रीजनिंग टोकन 397,671 15,470
प्रतिक्रिया समय (औसत) 37.19s 9.04s
प्रतिक्रिया समय (अधिकतम) 177.08s 53.91s
प्रतिक्रिया समय (कुल) 818.19s 198.97s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3.8 Flash

high
लागत
$0.077
समय
129.1s
टोकन
20,373 tok

#5 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.8 Flash 10.0 10.0 100.0% 0 29.30s 8,118 462 50,196
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

त्वरित तुलना

तुलना जोड़ी बदलें