नेविगेशन
AI BENCHY
Advertise here

Gemini 3.5 Flash Lite (medium) vs GPT-5.6 Luna (high)

Gemini 3.5 Flash Lite (medium) average score में आगे है: 7.8 vs 7.7. GPT-5.6 Luna (high) की benchmark लागत कम है: $0.102 vs $0.273. Gemini 3.5 Flash Lite (medium) तेज है: 5.20s vs 18.68s, pass rates 78.8% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-11

रैंक
#54
कुल आउटपुट टोकन
96,653
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.273
रैंक
#62
कुल आउटपुट टोकन
155,998
प्रतिक्रिया समय (औसत)
18.68s
कुल लागत
$0.102
अनुशंसित मॉडल Gemini 3.5 Flash Lite (medium)

It has the best score here (7.8), while responding about 3.6x faster than GPT-5.6 Luna (high).

विस्तृत तुलना

मेट्रिक Gemini 3.5 Flash Lite Gemini 3.5 Flash Lite medium रिलीज़: 2026-07-21 GPT-5.6 Luna GPT-5.6 Luna high रिलीज़: 2026-07-09
स्कोर 7.8 7.7
रैंक #54 #62
विश्वसनीयता 10.0 10.0
संगति 7.8 8.9
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 78.8% 72.7%
अस्थिर टेस्ट 6 3
कुल रन 66 66
प्रति परिणाम लागत 1.949 6.780
कुल लागत $0.273 $0.102
इनपुट कीमत $0.300 / 1M $0.100 / 1M
आउटपुट कीमत $2.500 / 1M $0.600 / 1M
कुल इनपुट टोकन 103,903 80,918
आउटपुट टोकन 8,892 5,088
रीजनिंग टोकन 87,761 150,910
प्रतिक्रिया समय (औसत) 5.20s 18.68s
प्रतिक्रिया समय (अधिकतम) 26.41s 111.09s
प्रतिक्रिया समय (कुल) 114.46s 411.05s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#54 Gemini 3.5 Flash Lite

medium
लागत
$0.010
समय
17.8s
टोकन
4,000 tok

#62 GPT-5.6 Luna

high
लागत
$0.033
समय
34.2s
टोकन
5,484 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash Lite 7.9 9.9 66.7% 0 9.96s 8,122 471 28,930
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746

त्वरित तुलना

तुलना जोड़ी बदलें