नेविगेशन
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite vs GPT-5.6 Luna (low)

GPT-5.6 Luna (low) average score में आगे है: 6.2 vs 6.1. Gemini 3.1 Flash Lite की benchmark लागत कम है: $0.046 vs $0.051. Gemini 3.1 Flash Lite तेज है: 1.75s vs 5.20s, pass rates 50.0% vs 54.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#173
कुल आउटपुट टोकन
10,723
प्रतिक्रिया समय (औसत)
1.75s
कुल लागत
$0.046
रैंक
#167
कुल आउटपुट टोकन
26,286
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.051
अनुशंसित मॉडल Gemini 3.1 Flash Lite

Its score stays close to the best score here (6.1 vs 6.2), while responding about 3.0x faster than GPT-5.6 Luna (low).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite none रिलीज़: 2026-05-08 GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09
स्कोर 6.1 6.2
रैंक #173 #167
विश्वसनीयता 10.0 10.0
संगति 8.6 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 50.0% 54.5%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 0.507 2.437
कुल लागत $0.046 $0.051
इनपुट कीमत $0.250 / 1M $0.200 / 1M
आउटपुट कीमत $1.500 / 1M $1.200 / 1M
कुल इनपुट टोकन 118,059 96,355
आउटपुट टोकन 10,723 8,213
रीजनिंग टोकन 0 18,073
प्रतिक्रिया समय (औसत) 1.75s 5.20s
प्रतिक्रिया समय (अधिकतम) 16.25s 19.44s
प्रतिक्रिया समय (कुल) 38.42s 114.46s
पैरामीटर ~150B कुल (~10B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#173 Gemini 3.1 Flash Lite

none
लागत
$0.001
समय
4.5s
टोकन
727 tok

#167 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 938ms 8,128 666 0
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

त्वरित तुलना

तुलना जोड़ी बदलें