নেভিগেশন
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.2 (medium) vs Qwen3.8 27B (high)

average score প্রায় সমান: 8.4 vs 8.4. Qwen3.8 27B (high)-এর benchmark খরচ কম: ~$0.287 vs $1.182. GPT-5.2 (medium) দ্রুত: 28.51s vs 167.89s, pass rates 72.7% vs 77.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-28

তুলনা করা মডেল

র‍্যাঙ্ক
#64
মোট আউটপুট টোকেন
71,252
প্রতিক্রিয়া সময় (গড়)
28.51s
মোট খরচ
$1.182
র‍্যাঙ্ক
#65
মোট আউটপুট টোকেন
656,635
প্রতিক্রিয়া সময় (গড়)
167.89s
মোট খরচ
~$0.287
প্রস্তাবিত মডেল Qwen3.8 27B (high)

It has the best score here (8.4), while costing about 4.1x less than GPT-5.2 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 GPT-5.2 medium প্রকাশ: 2025-12-11 Qwen3.8 27B Qwen3.8 27B high প্রকাশ: 2026-08-14
স্কোর 8.4 8.4
র‍্যাঙ্ক #64 #65
নির্ভরযোগ্যতা 10.0 9.6
ধারাবাহিকতা 8.5 9.2
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 77.3%
অস্থির টেস্ট 4 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.438 ~1.792
মোট খরচ $1.182 ~$0.287
ইনপুট মূল্য $1.750 / 1M প্রযোজ্য নয়
আউটপুট মূল্য $14.000 / 1M প্রযোজ্য নয়
মোট ইনপুট টোকেন 105,013 100,179
আউটপুট টোকেন 9,914 904
রিজনিং টোকেন 61,338 655,731
প্রতিক্রিয়া সময় (গড়) 28.51s 167.89s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 116.86s 640.85s
প্রতিক্রিয়া সময় (মোট) 456.13s 3693.54s
প্যারামিটার ~1.2T মোট (~80B সক্রিয়) 27.3B
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

#65 Qwen3.8 27B

high
খরচ
~$0.008
সময়
270.1s
টোকেন
18,963 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

দ্রুত তুলনা

তুলনার জুটি বদলান

Qwen3.8 27BhighvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27BhighGPT-5.2mediumvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.5lowGPT-6 SollowvsQwen3.8 27BhighGPT-5.2mediumvsInkling SmallhighQwen3.8 27BhighvsGLM 5.3 FlashXmaxQwen3.8 27BhighvsGrok 4.6mediumGPT-5.2mediumvsGLM 5.3 FlashXmaxDeepSeek V4.1 FlashmaxvsQwen3.8 27BhighDeepSeek V4.1 FlashmaxvsGPT-5.2mediumMuse Spark 1.2lowvsGPT-5.2medium