नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

तुलना किए गए मॉडल

सारांश

Gemma 4 31B vs Gemini 3 PRO Preview vs GLM 5 Turbo benchmark तुलनाGLM 5 Turbo स्कोर में 8.4 के साथ आगे है। Gemma 4 31B विश्वसनीयता में 10.0 के साथ आगे है। Gemma 4 31B का कुल लागत सबसे कम है: $0.033. Gemini 3 PRO Preview 9.05s पर सबसे तेज है।

अनुशंसित मॉडल: GLM 5 Turbo - It has the strongest score in this comparison (8.4) and the best overall balance of cost and response time across all 3 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक Gemma 4 31B Gemma 4 31B medium रिलीज़: 2026-04-02 निःशुल्क उपलब्ध Gemini 3 PRO Preview Gemini 3 PRO Preview medium रिलीज़: 2025-11-18 GLM 5 Turbo GLM 5 Turbo medium रिलीज़: 2026-03-15
स्कोर 6.3 6.2 8.4
रैंक #91 #94 #21
विश्वसनीयता 10.0 लागू नहीं 10.0
संगति 9.4 10.0 8.5
सही परीक्षण
प्रति प्रयास पास दर 69.8% 66.7% 74.6%
अस्थिर टेस्ट 1 0 4
कुल रन 63 63 63
प्रति परिणाम लागत 0.257 1.406 2.011
कुल लागत $0.033 $0.385 $0.323
इनपुट कीमत $0.120 / 1M $9.506 / 1M $1.200 / 1M
आउटपुट कीमत $0.350 / 1M $9.506 / 1M $4.000 / 1M
कुल इनपुट टोकन 17,957 28,848 35,593
आउटपुट टोकन 22,356 1,490 12,245
रीजनिंग टोकन 65,726 10,102 62,277
प्रतिक्रिया समय (औसत) 56.55s 9.05s 23.00s
प्रतिक्रिया समय (अधिकतम) 437.40s 26.24s 194.23s
प्रतिक्रिया समय (कुल) 1074.41s 90.53s 482.97s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 Gemma 4 31B

medium
लागत
$0.002
समय
45.7s
टोकन
2,696 tok

#94 Gemini 3 PRO Preview

medium
No endpoints found for google/gemini-3-pro-preview.
लागत
$0.000
समय
0.1s
टोकन
0 tok

#21 GLM 5 Turbo

medium
लागत
$0.074
समय
206.0s
टोकन
18,549 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 816 962 2,046
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 14.99s 500 149 1,485
GLM 5 Turbo 10.0 10.0 100.0% 0 4.82s 555 362 3,137
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
Gemini 3 PRO Preview 3.0 10.0 0.0% 0 0ms 0 0 0
GLM 5 Turbo 8.2 9.3 66.7% 0 45.90s 5,941 363 25,381
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Gemini 3 PRO Preview 3.0 10.0 0.0% 0 10.37s 13,211 351 952
GLM 5 Turbo 10.0 10.0 100.0% 0 13.88s 12,714 390 2,037
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 8,334 1,822 2,951
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 10.84s 7,259 279 3,156
GLM 5 Turbo 10.0 10.0 100.0% 0 6.19s 7,107 577 3,632
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 876 4,349 8,985
Gemini 3 PRO Preview 5.3 10.0 33.3% 0 7.01s 643 15 1,195
GLM 5 Turbo 2.9 4.4 22.2% 2 71.07s 489 9,665 19,279
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 567 105 888
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 9.34s 486 78 374
GLM 5 Turbo 6.1 3.1 66.7% 1 10.05s 477 60 2,216
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 777 533 2,035
Gemini 3 PRO Preview 9.8 10.0 100.0% 0 3.26s 623 69 754
GLM 5 Turbo 10.0 10.0 100.0% 0 5.38s 636 255 2,183
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 9.9 10.0 100.0% 0 26.91s 801 1,795 5,595
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 3.88s 570 225 1,215
GLM 5 Turbo 8.7 7.9 77.8% 1 5.23s 609 312 2,647
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 11.96s 5,556 324 971
GLM 5 Turbo 10.0 10.0 100.0% 0 9.84s 6,879 241 446
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 3.0 10.0 0.0% 0 90.14s 218 1,692 10,014
Gemini 3 PRO Preview 3.0 10.0 0.0% 0 0ms 0 0 0
GLM 5 Turbo 3.0 10.0 0.0% 0 40.17s 186 20 1,319

त्वरित तुलना

तुलना जोड़ी बदलें