नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Google: Gemma 4 31B vs OpenAI: GPT-5.2 Chat

सारांश

GPT-5.2 Chat average score में आगे है: 8.5 vs 6.3. Gemma 4 31B (medium) की benchmark लागत कम है: $0.032 vs $0.393. GPT-5.2 Chat तेज है: 7.13s vs 56.55s, pass rates 69.8% vs 74.6%.

अनुशंसित मॉडलGPT-5.2 ChatIt has the best score here (8.5), while responding about 7.9x faster than Gemma 4 31B (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-14

मेट्रिक Gemma 4 31B Gemma 4 31B medium रिलीज़: 2026-04-02 निःशुल्क उपलब्ध GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 6.3 8.5
रैंक #107 #22
विश्वसनीयता 10.0 10.0
संगति 9.4 8.9
सही परीक्षण
प्रति प्रयास पास दर 69.8% 74.6%
अस्थिर टेस्ट 1 3
कुल रन 63 63
प्रति परिणाम लागत 0.257 2.803
कुल लागत $0.032 $0.393
इनपुट कीमत $0.060 / 1M $1.750 / 1M
आउटपुट कीमत $0.350 / 1M $14.000 / 1M
कुल इनपुट टोकन 17,957 34,212
आउटपुट टोकन 22,356 23,744
रीजनिंग टोकन 65,726 0
प्रतिक्रिया समय (औसत) 56.55s 7.13s
प्रतिक्रिया समय (अधिकतम) 437.40s 38.52s
प्रतिक्रिया समय (कुल) 1074.41s 149.69s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#107 Gemma 4 31B

medium
लागत
$0.002
समय
45.7s
टोकन
2,696 tok

#22 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

त्वरित तुलना

तुलना जोड़ी बदलें