নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.2 Chat

সারাংশ

Gemini 3.1 Flash Lite vs GPT-5.2 Chat benchmark তুলনা: GPT-5.2 Chat average score-এ এগিয়ে: 8.5 vs 7.8. Gemini 3.1 Flash Lite-এর benchmark খরচ কম: $0.071 vs $0.393. Gemini 3.1 Flash Lite দ্রুত: 3.23s vs 7.13s, pass rates 65.1% vs 74.6%.

প্রস্তাবিত মডেল: Gemini 3.1 Flash Lite - Its score stays close to the best score here (7.8 vs 8.5), while costing about 5.6x less than GPT-5.2 Chat.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium প্রকাশ: 2026-05-08 GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11
স্কোর 7.8 8.5
র‍্যাঙ্ক #34 #19
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.2 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.1% 74.6%
অস্থির টেস্ট 2 3
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.539 2.803
মোট খরচ $0.071 $0.393
ইনপুট মূল্য $0.250 / 1M $1.750 / 1M
আউটপুট মূল্য $1.500 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 36,808 34,212
আউটপুট টোকেন 2,254 23,744
রিজনিং টোকেন 38,300 0
প্রতিক্রিয়া সময় (গড়) 3.23s 7.13s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 10.87s 38.52s
প্রতিক্রিয়া সময় (মোট) 67.80s 149.69s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#34 Gemini 3.1 Flash Lite

medium
খরচ
$0.003
সময়
5.3s
টোকেন
1,754 tok

#19 GPT-5.2 Chat

none
খরচ
$0.010
সময়
15.3s
টোকেন
797 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 9.1 10.0 75.0% 0 2.39s 502 604 4,201
GPT-5.2 Chat 8.7 7.9 91.7% 1 3.40s 606 1,807 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 3.81s 8,134 459 8,978
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 10.87s 12,873 327 7,401
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 11,019 1,243 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 7,362 279 2,845
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 7,140 980 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 3.16s 643 15 5,165
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 723 7,810 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 488 84 1,142
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 477 335 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 9.9 10.0 100.0% 0 2.59s 623 75 3,320
GPT-5.2 Chat 9.8 10.0 100.0% 0 5.51s 660 1,441 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 7.6 7.2 77.8% 1 1.95s 568 165 2,450
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.10s 642 1,603 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 4.55s 5,457 234 921
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 5,445 555 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 3.08s 158 12 1,877
GPT-5.2 Chat 3.0 10.0 0.0% 0 6.89s 195 1,239 0

দ্রুত তুলনা

তুলনার জুটি বদলান