नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Google: Gemma 4 31B vs MoonshotAI: Kimi K2.6

सारांश

Gemma 4 31B vs Kimi K2.6 benchmark तुलना: Gemma 4 31B average score में आगे है: 6.1 vs 5.8. Gemma 4 31B की benchmark लागत कम है: $0.004 vs $0.079. Gemma 4 31B तेज है: 4.05s vs 13.27s, pass rates 47.6% vs 36.5%.

अनुशंसित मॉडल: Gemma 4 31B - It has the best score here (6.1), while costing about 26.1x less than Kimi K2.6.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक Gemma 4 31B Gemma 4 31B none रिलीज़: 2026-04-02 निःशुल्क उपलब्ध Kimi K2.6 Kimi K2.6 none रिलीज़: 2026-04-20 निःशुल्क उपलब्ध
स्कोर 6.1 5.8
रैंक #98 #111
विश्वसनीयता 10.0 10.0
संगति 10.0 9.2
सही परीक्षण
प्रति प्रयास पास दर 47.6% 36.5%
अस्थिर टेस्ट 0 2
कुल रन 63 63
प्रति परिणाम लागत 0.034 1.267
कुल लागत $0.004 $0.079
इनपुट कीमत $0.120 / 1M $0.680 / 1M
आउटपुट कीमत $0.350 / 1M $3.410 / 1M
कुल इनपुट टोकन 20,911 32,916
आउटपुट टोकन 1,407 16,410
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 4.05s 13.27s
प्रतिक्रिया समय (अधिकतम) 26.13s 238.89s
प्रतिक्रिया समय (कुल) 76.87s 278.57s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Gemma 4 31B

none
लागत
$0.001
समय
12.8s
टोकन
795 tok

#111 MoonshotAI: Kimi K2.6

none
लागत
$0.020
समय
127.4s
टोकन
4,429 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 852 45 0
Kimi K2.6 4.6 10.0 25.0% 0 1.39s 618 471 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Kimi K2.6 3.0 10.0 0.0% 0 3.38s 11,269 290 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 8,352 285 0
Kimi K2.6 10.0 10.0 100.0% 0 1.32s 7,014 201 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 903 27 0
Kimi K2.6 5.3 7.2 44.4% 1 1.48s 732 42 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 576 117 0
Kimi K2.6 5.4 3.5 33.3% 1 1.55s 477 138 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 795 78 0
Kimi K2.6 6.5 10.0 50.0% 0 1.64s 669 72 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 6.5 10.0 33.3% 0 4.23s 828 108 0
Kimi K2.6 3.1 9.9 0.0% 0 1.40s 651 185 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Kimi K2.6 10.0 10.0 100.0% 0 4.46s 5,286 240 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 1.25s 224 12 0
Kimi K2.6 3.0 10.0 0.0% 0 1.36s 214 17 0

त्वरित तुलना

तुलना जोड़ी बदलें