নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.3-Codex

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-05-22

মেট্রিক Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite high প্রকাশ: 2026-05-08 GPT-5.3-Codex GPT-5.3-Codex medium প্রকাশ: 2026-02-05
স্কোর 7.5 8.3
র‍্যাঙ্ক #48 #15
নির্ভরযোগ্যতা 9.8 10.0
ধারাবাহিকতা 8.1 8.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 74.1% 81.7%
অস্থির টেস্ট 4 4
মোট রান 54 60
প্রতি ফলাফলে খরচ 18.579 4.891
মোট খরচ $2.044 $0.685
???? ??? $0.250 / 1M $1.750 / 1M
????? ??? $1.500 / 1M $14.000 / 1M
আউটপুট টোকেন 1,984 2,332
রিজনিং টোকেন 1,355,583 42,616
প্রতিক্রিয়া সময় (গড়) 61.96s 15.97s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 149.23s 100.93s
প্রতিক্রিয়া সময় (মোট) 1115.31s 319.30s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 9.4 10.0 100.0% 0 37.16s 100 130,598
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 240 1,722
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 137.63s 666 188,733
GPT-5.3-Codex 10.0 10.0 100.0% 0 18.45s 514 7,266
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 149.23s 327 198,243
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 364 2,731
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 4.49s 279 7,351
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 234 728
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 3.6 7.2 22.2% 1 139.90s 18 566,210
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 64 25,308
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 5.0 2.1 66.7% 1 45.69s 95 64,644
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 187 331
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 7.3 5.8 83.3% 1 23.26s 52 3,549
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 93 693
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 5.7 6.8 44.4% 1 50.83s 213 193,654
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.12s 352 1,644
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 6.44s 234 2,601
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 254 492
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite - - - - - - - -
GPT-5.3-Codex 2.8 1.6 33.3% 1 14.43s 30 1,701

দ্রুত তুলনা

তুলনার জুটি বদলান