नेविगेशन
Advertise here

Gemini 3.5 Flash (high) vs GPT-6 Luna (medium)

average score लगभग बराबर है: 8.3 vs 8.3. GPT-6 Luna (medium) की benchmark लागत कम है: $0.047 vs $2.737. GPT-6 Luna (medium) तेज है: 18.07s vs 18.59s, pass rates 85.5% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#77
कुल आउटपुट टोकन
246,012
प्रतिक्रिया समय (औसत)
18.59s
कुल लागत
$2.737
रैंक
#79
कुल आउटपुट टोकन
53,161
प्रतिक्रिया समय (औसत)
18.07s
कुल लागत
$0.047
अनुशंसित मॉडल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 58.3x less than Gemini 3.5 Flash (high).

विस्तृत तुलना

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash high रिलीज़: 2026-05-19 GPT-6 Luna GPT-6 Luna medium रिलीज़: 2026-09-23
स्कोर 8.3 8.3
रैंक #77 #79
विश्वसनीयता 10.0 10.0
संगति 9.3 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 85.5% 73.9%
अस्थिर टेस्ट 2 3
कुल रन 69 69
प्रति परिणाम लागत 14.402 0.313
कुल लागत $2.737 $0.047
इनपुट कीमत $1.500 / 1M $0.100 / 1M
आउटपुट कीमत $9.000 / 1M $0.500 / 1M
कुल इनपुट टोकन 348,103 203,193
आउटपुट टोकन 11,045 5,751
रीजनिंग टोकन 234,967 47,410
प्रतिक्रिया समय (औसत) 18.59s 18.07s
प्रतिक्रिया समय (अधिकतम) 145.92s 66.44s
प्रतिक्रिया समय (कुल) 427.52s 415.53s
पैरामीटर ~500B कुल (~20B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#77 Gemini 3.5 Flash

high
लागत
$0.208
समय
118.2s
टोकन
23,158 tok

#79 GPT-6 Luna

medium
लागत
$0.002
समय
23.6s
टोकन
2,966 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.96s 8,118 456 47,129
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

त्वरित तुलना

तुलना जोड़ी बदलें