নেভিগেশন
AI BENCHY
Advertise here

Gemini 3.1 Pro Preview (medium) vs GPT-5.3 Chat

Gemini 3.1 Pro Preview (medium) average score-এ এগিয়ে: 9.2 vs 7.5. GPT-5.3 Chat-এর benchmark খরচ কম: $0.571 vs $1.361. GPT-5.3 Chat দ্রুত: 6.88s vs 21.47s, pass rates 90.9% vs 68.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#10
মোট আউটপুট টোকেন
97,958
প্রতিক্রিয়া সময় (গড়)
21.47s
মোট খরচ
$1.361
র‍্যাঙ্ক
#62
মোট আউটপুট টোকেন
30,854
প্রতিক্রিয়া সময় (গড়)
6.88s
মোট খরচ
$0.571
প্রস্তাবিত মডেল Gemini 3.1 Pro Preview (medium)

It has the strongest score in this comparison (9.2) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium প্রকাশ: 2026-02-19 GPT-5.3 Chat GPT-5.3 Chat none প্রকাশ: 2026-03-03
স্কোর 9.2 7.5
র‍্যাঙ্ক #10 #62
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 10.0 8.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 90.9% 68.2%
অস্থির টেস্ট 0 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.801 4.387
মোট খরচ $1.361 $0.571
ইনপুট মূল্য $2.000 / 1M $1.750 / 1M
আউটপুট মূল্য $12.000 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 92,287 78,990
আউটপুট টোকেন 5,232 30,854
রিজনিং টোকেন 92,726 0
প্রতিক্রিয়া সময় (গড়) 21.47s 6.88s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 88.68s 18.33s
প্রতিক্রিয়া সময় (মোট) 322.08s 151.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 Gemini 3.1 Pro Preview

medium
খরচ
$0.115
সময়
87.2s
টোকেন
9,629 tok

#62 GPT-5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

দ্রুত তুলনা

তুলনার জুটি বদলান