نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

موازنہ کیے گئے ماڈلز

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-04-16

میٹرک GPT-5.2 Chat GPT-5.2 Chat none اجرا: 2025-12-11 GPT-5.3 Chat GPT-5.3 Chat none اجرا: 2026-03-03 Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low اجرا: 2026-03-03
اسکور 7.9 7.7 8.1
درجہ #28 #35 #22
تسلسل 8.7 8.6 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 75.9% 68.5% 72.2%
غیر مستحکم ٹیسٹ 3 3 0
کل رنز 54 54 54
فی نتیجہ لاگت 2.424 3.082 0.168
کل لاگت $0.291 $0.340 $0.022
?? ?? ???? $1.750 / 1M $1.750 / 1M $0.250 / 1M
??? ?? ???? $14.000 / 1M $14.000 / 1M $1.500 / 1M
آؤٹ پٹ ٹوکنز 17,346 20,784 2,247
ریزننگ ٹوکنز 0 0 8,058
ردِعمل کا وقت (اوسط) 6.84s 5.88s 3.22s
ردِعمل کا وقت (زیادہ سے زیادہ) 38.52s 18.33s 11.91s
ردِعمل کا وقت (کل) 123.17s 105.90s 58.00s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 8.7 7.9 91.7% 1 3.40s 1,807 0
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 3,167 0
Gemini 3.1 Flash Lite Preview 8.3 10.0 75.0% 0 2.12s 462 1,638
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 10.0 10.0 100.0% 0 8.97s 1,345 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 9.32s 1,436 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.20s 630 372
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 1,243 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 11.91s 225 762
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 980 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 942 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.00s 291 696
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 7,810 0
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 8,264 0
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 2.36s 18 1,212
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 335 0
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 319 0
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 1.54s 69 384
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 7.5 6.1 83.3% 1 5.46s 1,528 0
GPT-5.3 Chat 8.3 10.0 50.0% 0 3.29s 1,455 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 72 753
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.42s 1,743 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.93s 1,726 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.76s 243 1,248
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 555 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 237 993

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں