नेविगेशन
AI BENCHY
Advertise here

Gemini 3.8 Flash (medium) vs GPT-5.6 Sol (low)

GPT-5.6 Sol (low) average score में आगे है: 9.5 vs 9.1. GPT-5.6 Sol (low) की benchmark लागत कम है: $0.357 vs $0.653. GPT-5.6 Sol (low) तेज है: 9.04s vs 14.50s, pass rates 92.4% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#17
कुल आउटपुट टोकन
154,908
प्रतिक्रिया समय (औसत)
14.50s
कुल लागत
$0.653
रैंक
#5
कुल आउटपुट टोकन
19,946
प्रतिक्रिया समय (औसत)
9.04s
कुल लागत
$0.357
अनुशंसित मॉडल GPT-5.6 Sol (low)

It has the best score here (9.5), while costing about 1.8x less than Gemini 3.8 Flash (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.8 Flash Gemini 3.8 Flash medium रिलीज़: 2026-09-02 GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09
स्कोर 9.1 9.5
रैंक #17 #5
विश्वसनीयता 10.0 10.0
संगति 9.3 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 92.4% 86.4%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 3.436 5.508
कुल लागत $0.653 $0.357
इनपुट कीमत $0.750 / 1M $2.000 / 1M
आउटपुट कीमत $3.750 / 1M $10.000 / 1M
कुल इनपुट टोकन 95,793 78,580
आउटपुट टोकन 7,066 4,476
रीजनिंग टोकन 147,842 15,470
प्रतिक्रिया समय (औसत) 14.50s 9.04s
प्रतिक्रिया समय (अधिकतम) 108.60s 53.91s
प्रतिक्रिया समय (कुल) 318.92s 198.97s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#17 Gemini 3.8 Flash

medium
लागत
$0.037
समय
54.6s
टोकन
9,712 tok

#5 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.8 Flash 8.0 9.9 66.7% 0 11.69s 8,118 454 19,433
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

त्वरित तुलना

तुलना जोड़ी बदलें