নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.3 Chat

সারাংশ

Gemini 3.1 Flash Lite vs GPT-5.3 Chat benchmark তুলনা: Gemini 3.1 Flash Lite average score-এ এগিয়ে: 7.8 vs 7.5. Gemini 3.1 Flash Lite-এর benchmark খরচ কম: $0.071 vs $0.433. Gemini 3.1 Flash Lite দ্রুত: 3.23s vs 6.34s, pass rates 65.1% vs 66.7%.

প্রস্তাবিত মডেল: Gemini 3.1 Flash Lite - It has the best score here (7.8), while costing about 6.2x less than GPT-5.3 Chat.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium প্রকাশ: 2026-05-08 GPT-5.3 Chat GPT-5.3 Chat none প্রকাশ: 2026-03-03
স্কোর 7.8 7.5
র‍্যাঙ্ক #34 #45
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.2 8.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.1% 66.7%
অস্থির টেস্ট 2 5
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.539 3.605
মোট খরচ $0.071 $0.433
ইনপুট মূল্য $0.250 / 1M $1.750 / 1M
আউটপুট মূল্য $1.500 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 36,808 34,209
আউটপুট টোকেন 2,254 26,617
রিজনিং টোকেন 38,300 0
প্রতিক্রিয়া সময় (গড়) 3.23s 6.34s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 10.87s 18.33s
প্রতিক্রিয়া সময় (মোট) 67.80s 133.13s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#34 Gemini 3.1 Flash Lite

medium
খরচ
$0.003
সময়
5.3s
টোকেন
1,754 tok

#45 GPT-5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 9.1 10.0 75.0% 0 2.39s 502 604 4,201
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 3.81s 8,134 459 8,978
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 10.87s 12,873 327 7,401
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 7,362 279 2,845
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 3.16s 643 15 5,165
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 488 84 1,142
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 9.9 10.0 100.0% 0 2.59s 623 75 3,320
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 7.6 7.2 77.8% 1 1.95s 568 165 2,450
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 4.55s 5,457 234 921
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 3.08s 158 12 1,877
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0

দ্রুত তুলনা

তুলনার জুটি বদলান