নেভিগেশন
AI BENCHY
Advertise here

GPT-5.2 (medium) vs Qwen3.8 Max (low)

Qwen3.8 Max (low) average score-এ এগিয়ে: 8.7 vs 8.4. Qwen3.8 Max (low)-এর benchmark খরচ কম: $0.687 vs $0.951. Qwen3.8 Max (low) দ্রুত: 21.19s vs 22.62s, pass rates 72.7% vs 84.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-04

র‍্যাঙ্ক
#30
মোট আউটপুট টোকেন
54,782
প্রতিক্রিয়া সময় (গড়)
22.62s
মোট খরচ
$0.951
র‍্যাঙ্ক
#23
মোট আউটপুট টোকেন
81,411
প্রতিক্রিয়া সময় (গড়)
21.19s
মোট খরচ
$0.687
প্রস্তাবিত মডেল Qwen3.8 Max (low)

It has the strongest score in this comparison (8.7) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 GPT-5.2 medium প্রকাশ: 2025-12-11 Qwen3.8 Max Qwen3.8 Max low প্রকাশ: 2026-08-04
স্কোর 8.4 8.7
র‍্যাঙ্ক #30 #23
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 9.0
বেঞ্চমার্ক কভারেজ 22/22 টেস্ট · 66/66 প্রচেষ্টা 22/22 টেস্ট · 66/66 প্রচেষ্টা
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 84.9%
অস্থির টেস্ট 4 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.791 4.041
মোট খরচ $0.951 $0.687
ইনপুট মূল্য $1.750 / 1M $2.000 / 1M
আউটপুট মূল্য $14.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 105,004 99,172
আউটপুট টোকেন 9,914 6,132
রিজনিং টোকেন 44,868 75,279
প্রতিক্রিয়া সময় (গড়) 22.62s 21.19s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 102.93s 155.75s
প্রতিক্রিয়া সময় (মোট) 339.28s 466.14s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

#23 Qwen3.8 Max

low
খরচ
$0.026
সময়
68.5s
টোকেন
4,280 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Qwen3.8 Max 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952

দ্রুত তুলনা

তুলনার জুটি বদলান