नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Google: Gemini 3 Flash Preview vs Google: Gemma 4 31B

सारांश

Gemini 3 Flash Preview vs Gemma 4 31B benchmark तुलना: Gemini 3 Flash Preview average score में आगे है: 9.6 vs 6.3. Gemma 4 31B की benchmark लागत कम है: $0.033 vs $0.667. Gemini 3 Flash Preview तेज है: 18.64s vs 56.55s, pass rates 98.4% vs 69.8%.

अनुशंसित मॉडल: Gemini 3 Flash Preview - It has the best score here (9.6), while responding about 3.0x faster than Gemma 4 31B.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक Gemini 3 Flash Preview Gemini 3 Flash Preview medium रिलीज़: 2025-12-17 Gemma 4 31B Gemma 4 31B medium रिलीज़: 2026-04-02 निःशुल्क उपलब्ध
स्कोर 9.6 6.3
रैंक #2 #91
विश्वसनीयता 10.0 10.0
संगति 9.7 9.4
सही परीक्षण
प्रति प्रयास पास दर 98.4% 69.8%
अस्थिर टेस्ट 1 1
कुल रन 63 63
प्रति परिणाम लागत 3.335 0.257
कुल लागत $0.667 $0.033
इनपुट कीमत $0.500 / 1M $0.120 / 1M
आउटपुट कीमत $3.000 / 1M $0.350 / 1M
कुल इनपुट टोकन 37,017 17,957
आउटपुट टोकन 2,006 22,356
रीजनिंग टोकन 214,153 65,726
प्रतिक्रिया समय (औसत) 18.64s 56.55s
प्रतिक्रिया समय (अधिकतम) 117.26s 437.40s
प्रतिक्रिया समय (कुल) 391.35s 1074.41s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3 Flash Preview

medium
लागत
$0.010
समय
17.9s
टोकन
3,236 tok

#91 Gemma 4 31B

medium
लागत
$0.002
समय
45.7s
टोकन
2,696 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.88s 494 330 3,216
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 816 962 2,046
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 8.6 7.6 88.9% 1 84.40s 8,122 462 161,084
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 22.42s 12,873 351 10,485
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.43s 7,548 279 4,893
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 8,334 1,822 2,951
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 15.27s 633 12 21,684
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 876 4,349 8,985
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.19s 486 72 1,905
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 567 105 888
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.04s 615 72 2,709
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 777 533 2,035
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.05s 558 183 4,365
Gemma 4 31B 9.9 10.0 100.0% 0 26.91s 801 1,795 5,595
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 12.60s 5,532 234 1,487
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.50s 156 11 2,325
Gemma 4 31B 3.0 10.0 0.0% 0 90.14s 218 1,692 10,014

त्वरित तुलना

तुलना जोड़ी बदलें