नेव्हिगेशन
AI BENCHY
Advertise here

Gemma 4 31B vs LongCat 2.0

LongCat 2.0 average score मध्ये पुढे आहे: 6.4 vs 6.1. Gemma 4 31B चा benchmark खर्च कमी आहे: $0.016 vs $0.044. LongCat 2.0 वेगवान आहे: 5.17s vs 5.41s, pass rates 43.9% vs 40.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#178
एकूण आउटपुट टोकन्स
13,317
प्रतिसाद वेळ (सरासरी)
5.41s
एकूण खर्च
$0.016
क्रमांक
#159
एकूण आउटपुट टोकन्स
9,375
प्रतिसाद वेळ (सरासरी)
5.17s
एकूण खर्च
$0.044
शिफारस केलेले मॉडेल LongCat 2.0

It has the strongest score in this comparison (6.4) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Gemma 4 31B Gemma 4 31B none प्रकाशन: 2026-04-02 मोफत उपलब्ध LongCat 2.0 LongCat 2.0 none प्रकाशन: 2026-07-20
स्कोअर 6.1 6.4
क्रमांक #178 #159
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.3
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 43.9% 40.9%
अस्थिर चाचण्या 1 2
एकूण रन 66 66
प्रति निकाल खर्च 0.366 0.549
एकूण खर्च $0.016 $0.044
इनपुट किंमत $0.090 / 1M $0.300 / 1M
आउटपुट किंमत $0.340 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 125,703 108,752
आउटपुट टोकन्स 13,317 9,375
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 5.41s 5.17s
प्रतिसाद वेळ (कमाल) 29.95s 48.38s
प्रतिसाद वेळ (एकूण) 108.12s 113.83s
पॅरामीटर्स 30.7B 1.6T एकूण (48B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#178 Gemma 4 31B

none
खर्च
$0.001
वेळ
12.8s
टोकन्स
795 tok

#159 LongCat 2.0

none
खर्च
$0.027
वेळ
411.7s
टोकन्स
22,283 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0

झटपट तुलना

तुलना जोडी बदला