नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.3 Chat

सारांश

Gemini 3.1 Flash Lite vs GPT-5.3 Chat benchmark तुलना: Gemini 3.1 Flash Lite average score में आगे है: 7.8 vs 7.5. Gemini 3.1 Flash Lite की benchmark लागत कम है: $0.071 vs $0.433. Gemini 3.1 Flash Lite तेज है: 3.23s vs 6.34s, pass rates 65.1% vs 66.7%.

अनुशंसित मॉडल: Gemini 3.1 Flash Lite - It has the best score here (7.8), while costing about 6.2x less than GPT-5.3 Chat.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium रिलीज़: 2026-05-08 GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03
स्कोर 7.8 7.5
रैंक #34 #45
विश्वसनीयता 10.0 10.0
संगति 9.2 8.1
सही परीक्षण
प्रति प्रयास पास दर 65.1% 66.7%
अस्थिर टेस्ट 2 5
कुल रन 63 63
प्रति परिणाम लागत 0.539 3.605
कुल लागत $0.071 $0.433
इनपुट कीमत $0.250 / 1M $1.750 / 1M
आउटपुट कीमत $1.500 / 1M $14.000 / 1M
कुल इनपुट टोकन 36,808 34,209
आउटपुट टोकन 2,254 26,617
रीजनिंग टोकन 38,300 0
प्रतिक्रिया समय (औसत) 3.23s 6.34s
प्रतिक्रिया समय (अधिकतम) 10.87s 18.33s
प्रतिक्रिया समय (कुल) 67.80s 133.13s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#34 Gemini 3.1 Flash Lite

medium
लागत
$0.003
समय
5.3s
टोकन
1,754 tok

#45 GPT-5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 9.1 10.0 75.0% 0 2.39s 502 604 4,201
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 3.81s 8,134 459 8,978
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 10.87s 12,873 327 7,401
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 7,362 279 2,845
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 3.16s 643 15 5,165
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 488 84 1,142
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 9.9 10.0 100.0% 0 2.59s 623 75 3,320
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 7.6 7.2 77.8% 1 1.95s 568 165 2,450
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 4.55s 5,457 234 921
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 3.08s 158 12 1,877
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0

त्वरित तुलना

तुलना जोड़ी बदलें