नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Google: Gemini 3.5 Flash vs xAI: Grok 4.3

सारांश

Gemini 3.5 Flash vs Grok 4.3 benchmark तुलना: Grok 4.3 average score में आगे है: 7.7 vs 7.0. Grok 4.3 की benchmark लागत कम है: $0.614 vs $1.079. Gemini 3.5 Flash तेज है: 9.93s vs 47.51s, pass rates 77.8% vs 71.4%.

अनुशंसित मॉडल: Grok 4.3 - It has the best score here (7.7), while costing about 1.8x less than Gemini 3.5 Flash.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-12

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash none रिलीज़: 2026-05-19 Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01
स्कोर 7.0 7.7
रैंक #66 #40
विश्वसनीयता 10.0 10.0
संगति 8.9 8.5
सही परीक्षण
प्रति प्रयास पास दर 77.8% 71.4%
अस्थिर टेस्ट 3 4
कुल रन 63 63
प्रति परिणाम लागत 7.190 4.724
कुल लागत $1.079 $0.614
इनपुट कीमत $1.500 / 1M $1.250 / 1M
आउटपुट कीमत $9.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 13,843 44,472
आउटपुट टोकन 117,518 1,981
रीजनिंग टोकन 0 221,382
प्रतिक्रिया समय (औसत) 9.93s 47.51s
प्रतिक्रिया समय (अधिकतम) 64.36s 216.69s
प्रतिक्रिया समय (कुल) 178.68s 997.68s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Gemini 3.5 Flash

none
Cost
$0.225
Time
125.5s
Tokens
25,004 tok

#40 xAI: Grok 4.3

medium
Cost
$0.009
Time
19.0s
Tokens
3,661 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.53s 492 5,101 0
Grok 4.3 10.0 10.0 100.0% 0 8.83s 2,010 88 8,207
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 8.8 7.8 88.9% 1 34.69s 8,122 75,927 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
Grok 4.3 10.0 10.0 100.0% 0 63.99s 12,909 234 15,301
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 6.5 10.0 50.0% 0 8.10s 2,781 5,895 0
Grok 4.3 10.0 10.0 100.0% 0 18.97s 7,761 180 9,546
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 7.6 7.2 77.8% 1 10.64s 633 17,910 0
Grok 4.3 5.3 7.2 44.4% 1 181.74s 1,764 14 111,300
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.46s 486 1,620 0
Grok 4.3 5.4 2.5 66.7% 1 24.70s 825 70 5,020
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 9.8 10.0 100.0% 0 3.38s 615 3,928 0
Grok 4.3 9.8 10.0 100.0% 0 18.58s 1,362 57 8,713
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.13s 558 4,640 0
Grok 4.3 5.9 7.2 55.6% 1 22.52s 1,689 128 14,468
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
Grok 4.3 10.0 10.0 100.0% 0 17.66s 7,263 168 4,615
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 2.8 1.6 33.3% 1 4.87s 156 2,497 0
Grok 4.3 3.0 10.0 0.0% 0 44.47s 549 14 12,986

त्वरित तुलना

तुलना जोड़ी बदलें