নেভিগেশন
AI BENCHY
Advertise here

GPT-5.2 Chat vs Qwen3.8 27B (low)

average score প্রায় সমান: 7.9 vs 7.9. স্থানীয় হার্ডওয়্যারের খরচ মাপা হয়নি, তাই খরচের তুলনা পাওয়া যায় না। GPT-5.2 Chat দ্রুত: 7.73s vs 39.11s, pass rates 69.7% vs 68.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#59
মোট আউটপুট টোকেন
29,742
প্রতিক্রিয়া সময় (গড়)
7.73s
মোট খরচ
$0.594
র‍্যাঙ্ক
#61
মোট আউটপুট টোকেন
169,329
প্রতিক্রিয়া সময় (গড়)
39.11s
মোট খরচ
প্রযোজ্য নয়
প্রস্তাবিত মডেল GPT-5.2 Chat

It has the best score here (7.9), while responding about 5.1x faster than Qwen3.8 27B (low).

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11 Qwen3.8 27B Qwen3.8 27B low প্রকাশ: 2026-08-14
স্কোর 7.9 7.9
র‍্যাঙ্ক #59 #61
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.6 10.0
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 69.7% 68.2%
অস্থির টেস্ট 4 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.564 প্রযোজ্য নয়
মোট খরচ $0.594 প্রযোজ্য নয়
ইনপুট মূল্য $1.750 / 1M প্রযোজ্য নয়
আউটপুট মূল্য $14.000 / 1M প্রযোজ্য নয়
মোট ইনপুট টোকেন 101,104 99,705
আউটপুট টোকেন 29,742 1,545
রিজনিং টোকেন 0 167,784
প্রতিক্রিয়া সময় (গড়) 7.73s 39.11s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 38.52s 376.04s
প্রতিক্রিয়া সময় (মোট) 162.40s 860.51s
প্যারামিটার ~400B মোট (~17B সক্রিয়) 27.3B
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 GPT-5.2 Chat

none
খরচ
$0.010
সময়
15.3s
টোকেন
797 tok

#61 Qwen3.8 27B

low
খরচ
প্রযোজ্য নয়
সময়
92.8s
টোকেন
6,902 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694

দ্রুত তুলনা

তুলনার জুটি বদলান

GPT-5.2 ChatnonevsStep 3.7 FlashmediumKimi K3maxvsGPT-5.2 ChatnoneQwen3.8 27BlowvsStep 3.7 FlashmediumKimi K3maxvsQwen3.8 27BlowGPT-5.2 ChatnonevsQwen3.7 PlusmediumGPT-5.2 ChatnonevsInklingmediumGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumGPT-5.6 TerramediumvsQwen3.8 27BlowGPT-5.2 ChatnonevsQwen3.6 Plusmedium