नेविगेशन
Advertise here

Gemini 3 Flash Preview (medium) vs GPT-5.6 Sol (low)

GPT-5.6 Sol (low) average score में आगे है: 9.5 vs 9.5. GPT-5.6 Sol (low) की benchmark लागत कम है: $0.357 vs $0.763. GPT-5.6 Sol (low) तेज है: 9.04s vs 19.86s, pass rates 93.9% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#10
कुल आउटपुट टोकन
239,608
प्रतिक्रिया समय (औसत)
19.86s
कुल लागत
$0.763
रैंक
#8
कुल आउटपुट टोकन
19,946
प्रतिक्रिया समय (औसत)
9.04s
कुल लागत
$0.357
अनुशंसित मॉडल GPT-5.6 Sol (low)

It has the best score here (9.5), while costing about 2.1x less than Gemini 3 Flash Preview (medium).

विस्तृत तुलना

मेट्रिक Gemini 3 Flash Preview Gemini 3 Flash Preview medium रिलीज़: 2025-12-17 GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09
स्कोर 9.5 9.5
रैंक #10 #8
विश्वसनीयता 10.0 10.0
संगति 9.7 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 93.9% 86.4%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 3.814 5.508
कुल लागत $0.763 $0.357
इनपुट कीमत $0.500 / 1M $2.000 / 1M
आउटपुट कीमत $3.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 87,870 78,580
आउटपुट टोकन 5,486 4,476
रीजनिंग टोकन 234,122 15,470
प्रतिक्रिया समय (औसत) 19.86s 9.04s
प्रतिक्रिया समय (अधिकतम) 117.26s 53.91s
प्रतिक्रिया समय (कुल) 436.88s 198.97s
पैरामीटर ~500B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 Gemini 3 Flash Preview

medium
लागत
$0.010
समय
18.4s
टोकन
3,351 tok

#8 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 8.6 7.6 88.9% 1 84.40s 8,122 462 161,084
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

त्वरित तुलना

तुलना जोड़ी बदलें