नेविगेशन
AI BENCHY
Advertise here

Gemini 3.6 Flash (medium) vs GPT-5.6 Sol (low)

Gemini 3.6 Flash (medium) average score में आगे है: 9.8 vs 9.5. GPT-5.6 Sol (low) की benchmark लागत कम है: $0.357 vs $0.427. GPT-5.6 Sol (low) तेज है: 9.04s vs 11.86s, pass rates 95.5% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#7
कुल आउटपुट टोकन
100,876
प्रतिक्रिया समय (औसत)
11.86s
कुल लागत
$0.427
रैंक
#8
कुल आउटपुट टोकन
19,946
प्रतिक्रिया समय (औसत)
9.04s
कुल लागत
$0.357
अनुशंसित मॉडल GPT-5.6 Sol (low)

It offers the best overall trade-off: a competitive score (9.5), lower cost than Gemini 3.6 Flash (medium), and balanced response time.

विस्तृत तुलना

मेट्रिक Gemini 3.6 Flash Gemini 3.6 Flash medium रिलीज़: 2026-07-21 GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09
स्कोर 9.8 9.5
रैंक #7 #8
विश्वसनीयता 10.0 10.0
संगति 9.2 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 95.5% 86.4%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 4.101 5.508
कुल लागत $0.427 $0.357
इनपुट कीमत $0.750 / 1M $2.000 / 1M
आउटपुट कीमत $3.750 / 1M $10.000 / 1M
कुल इनपुट टोकन 64,446 78,580
आउटपुट टोकन 1,974 4,476
रीजनिंग टोकन 98,902 15,470
प्रतिक्रिया समय (औसत) 11.86s 9.04s
प्रतिक्रिया समय (अधिकतम) 77.15s 53.91s
प्रतिक्रिया समय (कुल) 260.96s 198.97s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#7 Gemini 3.6 Flash

medium
लागत
$0.095
समय
49.9s
टोकन
12,664 tok

#8 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.6 Flash 10.0 10.0 100.0% 0 14.81s 8,124 444 31,421
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

त्वरित तुलना

तुलना जोड़ी बदलें