नेविगेशन
Advertise here

Gemini 3.1 Flash Lite (medium) vs GPT-5.6 Luna (low)

average score लगभग बराबर है: 6.9 vs 6.9. GPT-5.6 Luna (low) की benchmark लागत कम है: $0.075 vs $0.153. Gemini 3.1 Flash Lite (medium) तेज है: 6.27s vs 6.96s, pass rates 59.4% vs 56.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#162
कुल आउटपुट टोकन
63,967
प्रतिक्रिया समय (औसत)
6.27s
कुल लागत
$0.153
रैंक
#165
कुल आउटपुट टोकन
28,001
प्रतिक्रिया समय (औसत)
6.96s
कुल लागत
$0.075
अनुशंसित मॉडल GPT-5.6 Luna (low)

It has the best score here (6.9), while costing about 2.1x less than Gemini 3.1 Flash Lite (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium रिलीज़: 2026-05-08 GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09
स्कोर 6.9 6.9
रैंक #162 #165
विश्वसनीयता 10.0 10.0
संगति 9.2 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 59.4% 56.5%
अस्थिर टेस्ट 2 5
कुल रन 69 69
प्रति परिणाम लागत 1.177 2.428
कुल लागत $0.153 $0.075
इनपुट कीमत $0.250 / 1M $0.200 / 1M
आउटपुट कीमत $1.500 / 1M $1.200 / 1M
कुल इनपुट टोकन 228,023 202,680
आउटपुट टोकन 10,779 9,230
रीजनिंग टोकन 53,188 18,771
प्रतिक्रिया समय (औसत) 6.27s 6.96s
प्रतिक्रिया समय (अधिकतम) 47.78s 45.74s
प्रतिक्रिया समय (कुल) 144.10s 160.19s
पैरामीटर ~150B कुल (~10B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#162 Gemini 3.1 Flash Lite

medium
लागत
$0.003
समय
5.3s
टोकन
1,754 tok

#165 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 3.81s 8,134 459 8,978
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

त्वरित तुलना

तुलना जोड़ी बदलें