নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.5 Flash-Lite vs OpenAI: GPT-5.2 Chat

average score প্রায় সমান: 8.1 vs 8.0. Gemini 3.5 Flash-Lite (high)-এর benchmark খরচ কম: $0.584 vs $0.604. GPT-5.2 Chat দ্রুত: 7.65s vs 9.48s, pass rates 81.8% vs 74.2%.

প্রস্তাবিত মডেলGPT-5.2 ChatIt has the strongest score in this comparison (8.0) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-21

মেট্রিক Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high প্রকাশ: 2026-07-21 GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11
স্কোর 8.1 8.0
র‍্যাঙ্ক #31 #34
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.5 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 81.8% 74.2%
অস্থির টেস্ট 7 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.169 4.308
মোট খরচ $0.584 $0.604
ইনপুট মূল্য $0.300 / 1M $1.750 / 1M
আউটপুট মূল্য $2.500 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 105,138 101,248
আউটপুট টোকেন 8,315 30,424
রিজনিং টোকেন 212,507 0
প্রতিক্রিয়া সময় (গড়) 9.48s 7.65s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 43.93s 38.52s
প্রতিক্রিয়া সময় (মোট) 208.52s 168.39s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#31 Gemini 3.5 Flash-Lite

high
খরচ
$0.023
সময়
23.6s
টোকেন
9,128 tok

#34 GPT-5.2 Chat

none
খরচ
$0.010
সময়
15.3s
টোকেন
797 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

দ্রুত তুলনা

তুলনার জুটি বদলান