नेविगेशन
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite (minimal) vs GPT-5.6 Luna (low)

average score लगभग बराबर है: 6.1 vs 6.2. Gemini 3.1 Flash Lite (minimal) की benchmark लागत कम है: $0.047 vs $0.051. Gemini 3.1 Flash Lite (minimal) तेज है: 1.85s vs 5.20s, pass rates 51.5% vs 54.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#169
कुल आउटपुट टोकन
11,118
प्रतिक्रिया समय (औसत)
1.85s
कुल लागत
$0.047
रैंक
#167
कुल आउटपुट टोकन
26,286
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.051
अनुशंसित मॉडल Gemini 3.1 Flash Lite (minimal)

It has the best score here (6.1), while responding about 2.8x faster than GPT-5.6 Luna (low).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal रिलीज़: 2026-05-08 GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09
स्कोर 6.1 6.2
रैंक #169 #167
विश्वसनीयता 10.0 10.0
संगति 8.9 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 51.5% 54.5%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 0.465 2.437
कुल लागत $0.047 $0.051
इनपुट कीमत $0.250 / 1M $0.200 / 1M
आउटपुट कीमत $1.500 / 1M $1.200 / 1M
कुल इनपुट टोकन 119,076 96,355
आउटपुट टोकन 11,118 8,213
रीजनिंग टोकन 0 18,073
प्रतिक्रिया समय (औसत) 1.85s 5.20s
प्रतिक्रिया समय (अधिकतम) 12.97s 19.44s
प्रतिक्रिया समय (कुल) 40.74s 114.46s
पैरामीटर ~150B कुल (~10B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#169 Gemini 3.1 Flash Lite

minimal
लागत
$0.001
समय
3.7s
टोकन
635 tok

#167 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 831ms 8,126 666 0
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

त्वरित तुलना

तुलना जोड़ी बदलें