नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.2 Chat

सारांश

Gemini 3.1 Flash Lite vs GPT-5.2 Chat benchmark तुलना: GPT-5.2 Chat average score मध्ये पुढे आहे: 8.5 vs 7.8. Gemini 3.1 Flash Lite चा benchmark खर्च कमी आहे: $0.071 vs $0.393. Gemini 3.1 Flash Lite वेगवान आहे: 3.23s vs 7.13s, pass rates 65.1% vs 74.6%.

शिफारस केलेले मॉडेल: Gemini 3.1 Flash Lite - Its score stays close to the best score here (7.8 vs 8.5), while costing about 5.6x less than GPT-5.2 Chat.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-18

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium प्रकाशन: 2026-05-08 GPT-5.2 Chat GPT-5.2 Chat none प्रकाशन: 2025-12-11
स्कोअर 7.8 8.5
क्रमांक #34 #19
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.1% 74.6%
अस्थिर चाचण्या 2 3
एकूण रन 63 63
प्रति निकाल खर्च 0.539 2.803
एकूण खर्च $0.071 $0.393
इनपुट किंमत $0.250 / 1M $1.750 / 1M
आउटपुट किंमत $1.500 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 36,808 34,212
आउटपुट टोकन्स 2,254 23,744
रिझनिंग टोकन्स 38,300 0
प्रतिसाद वेळ (सरासरी) 3.23s 7.13s
प्रतिसाद वेळ (कमाल) 10.87s 38.52s
प्रतिसाद वेळ (एकूण) 67.80s 149.69s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#34 Gemini 3.1 Flash Lite

medium
खर्च
$0.003
वेळ
5.3s
टोकन्स
1,754 tok

#19 GPT-5.2 Chat

none
खर्च
$0.010
वेळ
15.3s
टोकन्स
797 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 9.1 10.0 75.0% 0 2.39s 502 604 4,201
GPT-5.2 Chat 8.7 7.9 91.7% 1 3.40s 606 1,807 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 3.81s 8,134 459 8,978
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 10.87s 12,873 327 7,401
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 11,019 1,243 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 7,362 279 2,845
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 7,140 980 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 3.16s 643 15 5,165
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 723 7,810 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 488 84 1,142
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 477 335 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 9.9 10.0 100.0% 0 2.59s 623 75 3,320
GPT-5.2 Chat 9.8 10.0 100.0% 0 5.51s 660 1,441 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 7.6 7.2 77.8% 1 1.95s 568 165 2,450
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.10s 642 1,603 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 4.55s 5,457 234 921
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 5,445 555 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 3.08s 158 12 1,877
GPT-5.2 Chat 3.0 10.0 0.0% 0 6.89s 195 1,239 0

झटपट तुलना

तुलना जोडी बदला