नेविगेशन
AI BENCHY
Advertise here

Gemma 4 31B (medium) vs GPT-5.6 Luna (low)

average score लगभग बराबर है: 6.2 vs 6.2. GPT-5.6 Luna (low) की benchmark लागत कम है: $0.051 vs $0.100. GPT-5.6 Luna (low) तेज है: 5.20s vs 78.59s, pass rates 65.2% vs 54.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#166
कुल आउटपुट टोकन
267,421
प्रतिक्रिया समय (औसत)
78.59s
कुल लागत
$0.100
रैंक
#167
कुल आउटपुट टोकन
26,286
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.051
अनुशंसित मॉडल GPT-5.6 Luna (low)

It has the best score here (6.2), while costing about 2.0x less than Gemma 4 31B (medium).

विस्तृत तुलना

मेट्रिक Gemma 4 31B Gemma 4 31B medium रिलीज़: 2026-04-02 निःशुल्क उपलब्ध GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09
स्कोर 6.2 6.2
रैंक #166 #167
विश्वसनीयता 10.0 10.0
संगति 8.7 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 54.5%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 1.152 2.437
कुल लागत $0.100 $0.051
इनपुट कीमत $0.090 / 1M $0.200 / 1M
आउटपुट कीमत $0.340 / 1M $1.200 / 1M
कुल इनपुट टोकन 94,969 96,355
आउटपुट टोकन 34,399 8,213
रीजनिंग टोकन 233,022 18,073
प्रतिक्रिया समय (औसत) 78.59s 5.20s
प्रतिक्रिया समय (अधिकतम) 437.40s 19.44s
प्रतिक्रिया समय (कुल) 1571.84s 114.46s
पैरामीटर 30.7B ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Gemma 4 31B

medium
लागत
$0.002
समय
45.7s
टोकन
2,696 tok

#167 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

त्वरित तुलना

तुलना जोड़ी बदलें