नेविगेशन
Advertise here

Gemini 3.8 Flash (medium) vs GPT-5.6 Luna (high)

average score लगभग बराबर है: 8.0 vs 8.0. GPT-5.6 Luna (high) की benchmark लागत कम है: $0.207 vs $0.769. Gemini 3.8 Flash (medium) तेज है: 16.64s vs 18.39s, pass rates 89.9% vs 71.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#94
कुल आउटपुट टोकन
167,486
प्रतिक्रिया समय (औसत)
16.64s
कुल लागत
$0.769
रैंक
#91
कुल आउटपुट टोकन
139,395
प्रतिक्रिया समय (औसत)
18.39s
कुल लागत
$0.207
अनुशंसित मॉडल GPT-5.6 Luna (high)

It has the best score here (8.0), while costing about 3.7x less than Gemini 3.8 Flash (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.8 Flash Gemini 3.8 Flash medium रिलीज़: 2026-09-02 GPT-5.6 Luna GPT-5.6 Luna high रिलीज़: 2026-07-09
स्कोर 8.0 8.0
रैंक #94 #91
विश्वसनीयता 9.9 10.0
संगति 9.0 8.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 89.9% 71.0%
अस्थिर टेस्ट 3 4
कुल रन 69 69
प्रति परिणाम लागत 4.046 5.882
कुल लागत $0.769 $0.207
इनपुट कीमत $0.750 / 1M $0.200 / 1M
आउटपुट कीमत $3.750 / 1M $1.200 / 1M
कुल इनपुट टोकन 187,331 197,896
आउटपुट टोकन 7,555 6,211
रीजनिंग टोकन 159,931 133,184
प्रतिक्रिया समय (औसत) 16.64s 18.39s
प्रतिक्रिया समय (अधिकतम) 108.60s 111.09s
प्रतिक्रिया समय (कुल) 382.64s 422.93s
पैरामीटर ~500B कुल (~20B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 Gemini 3.8 Flash

medium
लागत
$0.037
समय
54.6s
टोकन
9,712 tok

#91 GPT-5.6 Luna

high
लागत
$0.033
समय
34.2s
टोकन
5,484 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.8 Flash 8.0 9.9 66.7% 0 11.69s 8,118 454 19,433
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746

त्वरित तुलना

तुलना जोड़ी बदलें