नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Google: Gemma 4 31B vs OpenAI: GPT-5.2 Chat

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-02

मेट्रिक Gemma 4 31B Gemma 4 31B medium रिलीज़: 2026-04-02 GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 8.6 7.8
रैंक #5 #29
संगति 9.6 8.6
सही परीक्षण
प्रति प्रयास पास दर 80.4% 74.5%
अस्थिर टेस्ट 1 3
कुल रन 51 51
प्रति परिणाम लागत 0.109 2.462
कुल लागत $0.015 $0.271
???? ??? $0.140 / 1M $1.750 / 1M
????? ??? $0.400 / 1M $14.000 / 1M
आउटपुट टोकन 9,568 16,001
रीजनिंग टोकन 22,501 0
प्रतिक्रिया समय (औसत) 21.81s 6.72s
प्रतिक्रिया समय (अधिकतम) 68.92s 38.52s
प्रतिक्रिया समय (कुल) 327.16s 114.20s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 962 2,046
GPT-5.2 Chat 8.7 7.9 91.7% 1 3.40s 1,807 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 1,243 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 1,822 2,951
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 980 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 4,349 8,985
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 7,810 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 105 888
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 335 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 533 2,035
GPT-5.2 Chat 7.5 6.1 83.3% 1 5.46s 1,528 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 8.8 7.9 88.9% 1 27.63s 1,797 5,596
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.42s 1,743 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 555 0

त्वरित तुलना

तुलना जोड़ी बदलें