নেভিগেশন
Advertise here

GPT-6 Sol vs Qwen3.5-122B-A10B (medium)

average score প্রায় সমান: 7.2 vs 7.1. GPT-6 Sol-এর benchmark খরচ কম: $0.280 vs $1.047. GPT-6 Sol দ্রুত: 6.84s vs 65.67s, pass rates 66.7% vs 71.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-23

তুলনা করা মডেল

র‍্যাঙ্ক
#148
মোট আউটপুট টোকেন
6,696
প্রতিক্রিয়া সময় (গড়)
6.84s
মোট খরচ
$0.280
র‍্যাঙ্ক
#152
মোট আউটপুট টোকেন
487,519
প্রতিক্রিয়া সময় (গড়)
65.67s
মোট খরচ
$1.047
প্রস্তাবিত মডেল GPT-6 Sol

It has the best score here (7.2), while costing about 3.7x less than Qwen3.5-122B-A10B (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-6 Sol GPT-6 Sol none প্রকাশ: 2026-09-23 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium প্রকাশ: 2026-02-24
স্কোর 7.2 7.1
র‍্যাঙ্ক #148 #152
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 8.5
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 71.2%
অস্থির টেস্ট 4 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.151 8.446
মোট খরচ $0.280 $1.047
ইনপুট মূল্য $2.000 / 1M $0.260 / 1M
আউটপুট মূল্য $10.000 / 1M $2.080 / 1M
মোট ইনপুট টোকেন 106,332 124,780
আউটপুট টোকেন 6,696 47,694
রিজনিং টোকেন 0 439,825
প্রতিক্রিয়া সময় (গড়) 6.84s 65.67s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 23.89s 519.30s
প্রতিক্রিয়া সময় (মোট) 150.43s 1444.68s
প্যারামিটার ~2T মোট (~150B সক্রিয়) 122B মোট (10B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#148 GPT-6 Sol

none
খরচ
$0.030
সময়
31.9s
টোকেন
3,055 tok

#152 Qwen3.5-122B-A10B

medium
খরচ
$0.019
সময়
48.7s
টোকেন
6,034 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-6 Sol 5.5 10.0 33.3% 0 12.23s 7,302 389 0
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

দ্রুত তুলনা

তুলনার জুটি বদলান