नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

Google: Gemini 3 Flash Preview vs Grok 4.20 Beta

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-26

मेट्रिक Gemini 3 Flash Preview Gemini 3 Flash Preview medium रिलीज़: 2025-12-17 Grok 4.20 Beta Grok 4.20 Beta medium रिलीज़: 2026-03-12
स्कोर 10.0 8.0
रैंक #1 #31
विश्वसनीयता लागू नहीं लागू नहीं
संगति 10.0 9.1
सही परीक्षण
प्रति प्रयास पास दर 100.0% 74.1%
अस्थिर टेस्ट 0 2
कुल रन 18 52
प्रति परिणाम लागत 0.600 5.269
कुल लागत $0.108 $0.633
???? ??? $0.500 / 1M $0.000 / 1M
????? ??? $3.000 / 1M $0.000 / 1M
आउटपुट टोकन 655 1,568
रीजनिंग टोकन 33,749 91,909
प्रतिक्रिया समय (औसत) 12.11s 9.81s
प्रतिक्रिया समय (अधिकतम) 82.37s 31.36s
प्रतिक्रिया समय (कुल) 217.93s 176.62s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.26s 110 1,076
Grok 4.20 Beta 8.7 7.9 91.7% 1 3.16s 268 7,583
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 82.37s 144 16,257
Grok 4.20 Beta 10.0 10.0 100.0% 0 31.36s 81 3,987
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 23.58s 117 3,495
Grok 4.20 Beta 10.0 10.0 100.0% 0 20.93s 227 12,212
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 7.62s 93 2,197
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.01s 180 5,281
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 14.81s 4 7,228
Grok 4.20 Beta 5.3 10.0 33.3% 0 21.33s 251 40,255
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.34s 24 635
Grok 4.20 Beta 10.0 10.0 100.0% 0 5.78s 72 3,440
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.30s 24 903
Grok 4.20 Beta 8.3 10.0 50.0% 0 4.97s 57 7,107
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.86s 61 1,455
Grok 4.20 Beta 8.2 7.2 88.9% 1 3.85s 249 6,660
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 9.78s 78 503
Grok 4.20 Beta 3.0 10.0 0.0% 0 12.39s 183 5,384

त्वरित तुलना

तुलना जोड़ी बदलें