नेविगेशन
AI BENCHY
Advertise here

Gemini 3.8 Flash (medium) vs GPT-5.6 Sol (high)

GPT-5.6 Sol (high) average score में आगे है: 9.4 vs 9.1. GPT-5.6 Sol (high) की benchmark लागत कम है: $0.446 vs $0.653. GPT-5.6 Sol (high) तेज है: 11.48s vs 14.50s, pass rates 92.4% vs 89.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#17
कुल आउटपुट टोकन
154,908
प्रतिक्रिया समय (औसत)
14.50s
कुल लागत
$0.653
रैंक
#10
कुल आउटपुट टोकन
28,708
प्रतिक्रिया समय (औसत)
11.48s
कुल लागत
$0.446
अनुशंसित मॉडल GPT-5.6 Sol (high)

It has the strongest score in this comparison (9.4) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Gemini 3.8 Flash Gemini 3.8 Flash medium रिलीज़: 2026-09-02 GPT-5.6 Sol GPT-5.6 Sol high रिलीज़: 2026-07-09
स्कोर 9.1 9.4
रैंक #17 #10
विश्वसनीयता 10.0 10.0
संगति 9.3 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 92.4% 89.4%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत 3.436 6.987
कुल लागत $0.653 $0.446
इनपुट कीमत $0.750 / 1M $2.000 / 1M
आउटपुट कीमत $3.750 / 1M $10.000 / 1M
कुल इनपुट टोकन 95,793 79,258
आउटपुट टोकन 7,066 4,855
रीजनिंग टोकन 147,842 23,853
प्रतिक्रिया समय (औसत) 14.50s 11.48s
प्रतिक्रिया समय (अधिकतम) 108.60s 54.79s
प्रतिक्रिया समय (कुल) 318.92s 252.62s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#17 Gemini 3.8 Flash

medium
लागत
$0.037
समय
54.6s
टोकन
9,712 tok

#10 GPT-5.6 Sol

high
लागत
$0.151
समय
201.9s
टोकन
5,100 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.8 Flash 8.0 9.9 66.7% 0 11.69s 8,118 454 19,433
GPT-5.6 Sol 10.0 10.0 100.0% 0 12.52s 7,302 404 5,656

त्वरित तुलना

तुलना जोड़ी बदलें