नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Google: Gemini 3 Flash Preview vs xAI: Grok 4.20

सारांश

Gemini 3 Flash Preview vs Grok 4.20 benchmark तुलना: Grok 4.20 average score में आगे है: 7.3 vs 6.9. Gemini 3 Flash Preview की benchmark लागत कम है: $0.025 vs $0.609. Gemini 3 Flash Preview तेज है: 1.65s vs 27.68s, pass rates 66.7% vs 63.5%.

अनुशंसित मॉडल: Gemini 3 Flash Preview - Its score stays close to the best score here (6.9 vs 7.3), while costing about 25.2x less than Grok 4.20.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक Gemini 3 Flash Preview Gemini 3 Flash Preview none रिलीज़: 2025-12-17 Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर 6.9 7.3
रैंक #67 #53
विश्वसनीयता 10.0 10.0
संगति 9.2 8.8
सही परीक्षण
प्रति प्रयास पास दर 66.7% 63.5%
अस्थिर टेस्ट 2 3
कुल रन 63 63
प्रति परिणाम लागत 0.186 8.309
कुल लागत $0.025 $0.609
इनपुट कीमत $0.500 / 1M $1.250 / 1M
आउटपुट कीमत $3.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 37,011 44,433
आउटपुट टोकन 1,885 1,819
रीजनिंग टोकन 0 219,524
प्रतिक्रिया समय (औसत) 1.65s 27.68s
प्रतिक्रिया समय (अधिकतम) 3.56s 199.66s
प्रतिक्रिया समय (कुल) 23.07s 581.26s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Gemini 3 Flash Preview

none
लागत
$0.003
समय
5.6s
टोकन
981 tok

#53 xAI: Grok 4.20

medium
लागत
$0.041
समय
110.3s
टोकन
16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 8.3 10.0 75.0% 0 1.25s 498 214 0
Grok 4.20 8.2 7.9 83.3% 1 3.95s 2,010 287 8,312
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 5.5 10.0 33.3% 0 1.80s 8,122 453 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 4.7 1.6 66.7% 1 3.56s 12,862 350 0
Grok 4.20 10.0 10.0 100.0% 0 17.40s 12,909 232 9,556
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.41s 7,263 279 0
Grok 4.20 10.0 10.0 100.0% 0 4.17s 7,761 180 5,333
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 963ms 643 18 0
Grok 4.20 5.3 10.0 33.3% 0 27.03s 1,764 375 49,339
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.13s 490 104 0
Grok 4.20 3.9 2.6 33.3% 1 24.48s 825 65 6,440
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 6.4 5.8 66.7% 1 1.58s 619 74 0
Grok 4.20 9.8 10.0 100.0% 0 4.26s 1,362 57 6,419
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 1.05s 574 144 0
Grok 4.20 7.7 10.0 66.7% 0 6.22s 1,689 149 7,913
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.35s 5,784 234 0
Grok 4.20 3.0 10.0 0.0% 0 13.68s 7,275 197 6,620
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 3.0 10.0 0.0% 0 1.07s 156 15 0
Grok 4.20 3.0 10.0 0.0% 0 63.48s 531 9 16,442

त्वरित तुलना

तुलना जोड़ी बदलें