नेव्हिगेशन
AI BENCHY
Your ad here

AI BENCHY Compare

तुलना केलेली मॉडेल्स

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-16

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none प्रकाशन: 2025-12-11 GPT-5.3 Chat GPT-5.3 Chat none प्रकाशन: 2026-03-03 Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low प्रकाशन: 2026-03-03
स्कोअर 7.9 7.7 8.1
क्रमांक #28 #35 #22
सुसंगतता 8.7 8.6 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 75.9% 68.5% 72.2%
अस्थिर चाचण्या 3 3 0
एकूण रन 54 54 54
प्रति निकाल खर्च 2.424 3.082 0.168
एकूण खर्च $0.291 $0.340 $0.022
???? ??? $1.750 / 1M $1.750 / 1M $0.250 / 1M
????? ??? $14.000 / 1M $14.000 / 1M $1.500 / 1M
आउटपुट टोकन्स 17,346 20,784 2,247
रिझनिंग टोकन्स 0 0 8,058
प्रतिसाद वेळ (सरासरी) 6.84s 5.88s 3.22s
प्रतिसाद वेळ (कमाल) 38.52s 18.33s 11.91s
प्रतिसाद वेळ (एकूण) 123.17s 105.90s 58.00s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 8.7 7.9 91.7% 1 3.40s 1,807 0
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 3,167 0
Gemini 3.1 Flash Lite Preview 8.3 10.0 75.0% 0 2.12s 462 1,638
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 10.0 10.0 100.0% 0 8.97s 1,345 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 9.32s 1,436 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.20s 630 372
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 1,243 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 11.91s 225 762
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 980 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 942 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.00s 291 696
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 7,810 0
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 8,264 0
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 2.36s 18 1,212
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 335 0
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 319 0
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 1.54s 69 384
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 7.5 6.1 83.3% 1 5.46s 1,528 0
GPT-5.3 Chat 8.3 10.0 50.0% 0 3.29s 1,455 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 72 753
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.42s 1,743 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.93s 1,726 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.76s 243 1,248
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 555 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 237 993

झटपट तुलना

तुलना जोडी बदला