नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs OpenAI: GPT-5.3-Codex

सारांश

GPT-5.3-Codex (medium) average score मध्ये पुढे आहे: 8.9 vs 6.4. Gemini 3.1 Flash Lite Preview चा benchmark खर्च कमी आहे: $0.018 vs $0.740. Gemini 3.1 Flash Lite Preview वेगवान आहे: 1.21s vs 16.22s, pass rates 60.3% vs 82.5%.

शिफारस केलेले मॉडेलGPT-5.3-Codex (medium)It has the strongest score in this comparison (8.9) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-14

मेट्रिक Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none प्रकाशन: 2026-03-03 GPT-5.3-Codex GPT-5.3-Codex medium प्रकाशन: 2026-02-05
स्कोअर 6.4 8.9
क्रमांक #102 #13
विश्वसनीयता 10.0 10.0
सुसंगतता 9.7 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 60.3% 82.5%
अस्थिर चाचण्या 1 4
एकूण रन 63 63
प्रति निकाल खर्च 0.148 4.932
एकूण खर्च $0.018 $0.740
इनपुट किंमत $0.250 / 1M $1.750 / 1M
आउटपुट किंमत $1.500 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 37,582 34,299
आउटपुट टोकन्स 5,547 2,357
रिझनिंग टोकन्स 0 46,189
प्रतिसाद वेळ (सरासरी) 1.21s 16.22s
प्रतिसाद वेळ (कमाल) 3.39s 100.93s
प्रतिसाद वेळ (एकूण) 25.45s 340.67s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 Gemini 3.1 Flash Lite Preview

none
खर्च
$0.003
वेळ
4.7s
टोकन्स
1,827 tok

#13 GPT-5.3-Codex

medium
खर्च
$0.049
वेळ
54.9s
टोकन्स
3,580 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 967ms 8,128 670 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

झटपट तुलना

तुलना जोडी बदला