नेव्हिगेशन
AI BENCHY
Advertise here

Gemma 4 31B (medium) vs GPT-5.6 Luna (low)

average score जवळपास समान आहे: 6.2 vs 6.2. GPT-5.6 Luna (low) चा benchmark खर्च कमी आहे: $0.051 vs $0.100. GPT-5.6 Luna (low) वेगवान आहे: 5.20s vs 78.59s, pass rates 65.2% vs 54.5%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#166
एकूण आउटपुट टोकन्स
267,421
प्रतिसाद वेळ (सरासरी)
78.59s
एकूण खर्च
$0.100
क्रमांक
#167
एकूण आउटपुट टोकन्स
26,286
प्रतिसाद वेळ (सरासरी)
5.20s
एकूण खर्च
$0.051
शिफारस केलेले मॉडेल GPT-5.6 Luna (low)

It has the best score here (6.2), while costing about 2.0x less than Gemma 4 31B (medium).

तपशीलवार तुलना

मेट्रिक Gemma 4 31B Gemma 4 31B medium प्रकाशन: 2026-04-02 मोफत उपलब्ध GPT-5.6 Luna GPT-5.6 Luna low प्रकाशन: 2026-07-09
स्कोअर 6.2 6.2
क्रमांक #166 #167
विश्वसनीयता 10.0 10.0
सुसंगतता 8.7 8.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 54.5%
अस्थिर चाचण्या 3 5
एकूण रन 66 66
प्रति निकाल खर्च 1.152 2.437
एकूण खर्च $0.100 $0.051
इनपुट किंमत $0.090 / 1M $0.200 / 1M
आउटपुट किंमत $0.340 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 94,969 96,355
आउटपुट टोकन्स 34,399 8,213
रिझनिंग टोकन्स 233,022 18,073
प्रतिसाद वेळ (सरासरी) 78.59s 5.20s
प्रतिसाद वेळ (कमाल) 437.40s 19.44s
प्रतिसाद वेळ (एकूण) 1571.84s 114.46s
पॅरामीटर्स 30.7B ~400B एकूण (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Gemma 4 31B

medium
खर्च
$0.002
वेळ
45.7s
टोकन्स
2,696 tok

#167 GPT-5.6 Luna

low
खर्च
$0.011
वेळ
10.2s
टोकन्स
1,897 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

झटपट तुलना

तुलना जोडी बदला