नेविगेशन
AI BENCHY
Advertise here

Gemini 3.5 Flash (high) vs GPT-5.6 Sol (medium)

Gemini 3.5 Flash (high) average score में आगे है: 9.5 vs 9.4. GPT-5.6 Sol (medium) की benchmark लागत कम है: $1.316 vs $1.976. GPT-5.6 Sol (medium) तेज है: 11.35s vs 15.07s, pass rates 93.9% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-07

रैंक
#4
कुल आउटपुट टोकन
201,677
प्रतिक्रिया समय (औसत)
15.07s
कुल लागत
$1.976
रैंक
#6
कुल आउटपुट टोकन
30,698
प्रतिक्रिया समय (औसत)
11.35s
कुल लागत
$1.316
अनुशंसित मॉडल GPT-5.6 Sol (medium)

Its score stays close to the best score here (9.4 vs 9.5), while costing about 1.5x less than Gemini 3.5 Flash (high).

विस्तृत तुलना

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash high रिलीज़: 2026-05-19 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 9.5 9.4
रैंक #4 #6
विश्वसनीयता 10.0 10.0
संगति 9.3 8.9
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 93.9% 90.9%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत 9.879 7.311
कुल लागत $1.976 $1.316
इनपुट कीमत $1.500 / 1M $5.000 / 1M
आउटपुट कीमत $9.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 107,137 78,997
आउटपुट टोकन 8,777 4,696
रीजनिंग टोकन 192,900 26,002
प्रतिक्रिया समय (औसत) 15.07s 11.35s
प्रतिक्रिया समय (अधिकतम) 145.92s 79.40s
प्रतिक्रिया समय (कुल) 331.48s 249.73s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#4 Gemini 3.5 Flash

high
लागत
$0.208
समय
118.2s
टोकन
23,158 tok

#6 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.96s 8,118 456 47,129
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें