نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.3-Codex

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-05-22

میٹرک Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite high اجرا: 2026-05-08 GPT-5.3-Codex GPT-5.3-Codex medium اجرا: 2026-02-05
اسکور 7.5 8.3
درجہ #48 #15
اعتماد پذیری 9.8 10.0
تسلسل 8.1 8.4
درست ٹیسٹس
فی کوشش کامیابی کی شرح 74.1% 81.7%
غیر مستحکم ٹیسٹ 4 4
کل رنز 54 60
فی نتیجہ لاگت 18.579 4.891
کل لاگت $2.044 $0.685
?? ?? ???? $0.250 / 1M $1.750 / 1M
??? ?? ???? $1.500 / 1M $14.000 / 1M
آؤٹ پٹ ٹوکنز 1,984 2,332
ریزننگ ٹوکنز 1,355,583 42,616
ردِعمل کا وقت (اوسط) 61.96s 15.97s
ردِعمل کا وقت (زیادہ سے زیادہ) 149.23s 100.93s
ردِعمل کا وقت (کل) 1115.31s 319.30s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 9.4 10.0 100.0% 0 37.16s 100 130,598
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 240 1,722
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 137.63s 666 188,733
GPT-5.3-Codex 10.0 10.0 100.0% 0 18.45s 514 7,266
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 149.23s 327 198,243
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 364 2,731
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 4.49s 279 7,351
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 234 728
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 3.6 7.2 22.2% 1 139.90s 18 566,210
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 64 25,308
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 5.0 2.1 66.7% 1 45.69s 95 64,644
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 187 331
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 7.3 5.8 83.3% 1 23.26s 52 3,549
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 93 693
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 5.7 6.8 44.4% 1 50.83s 213 193,654
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.12s 352 1,644
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 6.44s 234 2,601
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 254 492
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite - - - - - - - -
GPT-5.3-Codex 2.8 1.6 33.3% 1 14.43s 30 1,701

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں