नेविगेशन
AI BENCHY
तुलना करें चार्ट
❤️ Made by XCS
Your ad here

AI BENCHY तुलना

Google: Gemini 3 Flash Preview vs OpenAI: GPT-5.4

तुलना करें:

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-05

मेट्रिक Google: Gemini 3 Flash Preview medium रिलीज़: 2025-12-17 OpenAI: GPT-5.4 none रिलीज़: 2026-03-05
रैंक #1 #44
औसत स्कोर 10.0 4.6
सही परीक्षण
संगति 10.0 8.9
प्रति परिणाम लागत 1.064 1.496
कुल लागत $0.160 $0.090
प्रति प्रयास पास दर 100.0% 44.4%
अस्थिर टेस्ट 0 2
common.totalAttempts 45 (15 x 3) 45 (15 x 3)
आउटपुट टोकन 1,523 1,635
रीजनिंग टोकन 46,622 0
प्रतिक्रिया समय (औसत) 13.39s 1.46s
प्रतिक्रिया समय (अधिकतम) 50.16s 2.89s
प्रतिक्रिया समय (कुल) 107.12s 21.86s

स्कोर के अनुसार शीर्ष मॉडल

प्रतिक्रिया समय (औसत)

स्कोर बनाम कुल लागत

औसत स्कोर vs प्रतिक्रिया समय (औसत)

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.61s 299 3,127
OpenAI: GPT-5.4 10.0 7.3 11.1% 1 1.41s 388 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 50.16s 351 12,645
OpenAI: GPT-5.4 10.0 10.0 0.0% 0 2.89s 291 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Google: Gemini 3 Flash Preview 9.9 10.0 100.0% 0 4.72s 279 5,333
OpenAI: GPT-5.4 9.9 10.0 100.0% 0 1.04s 222 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 21.12s 12 14,908
OpenAI: GPT-5.4 4.0 7.2 44.4% 1 1.07s 50 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.10s 72 4,558
OpenAI: GPT-5.4 5.5 10.0 50.0% 0 1.07s 81 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.43s 276 4,921
OpenAI: GPT-5.4 4.0 9.8 33.3% 0 1.52s 357 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 10.55s 234 1,130
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 2.75s 246 0

त्वरित तुलना

तुलना जोड़ी बदलें