নেভিগেশন
AI BENCHY
Advertise here

gpt-oss-120b (medium) vs Qwen3.5 Plus 2026-04-20

average score প্রায় সমান: 6.1 vs 6.1. gpt-oss-120b (medium)-এর benchmark খরচ কম: $0.019 vs $0.122. Qwen3.5 Plus 2026-04-20 দ্রুত: 13.56s vs 21.91s, pass rates 50.0% vs 43.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#132
মোট আউটপুট টোকেন
97,816
প্রতিক্রিয়া সময় (গড়)
21.91s
মোট খরচ
$0.019
র‍্যাঙ্ক
#137
মোট আউটপুট টোকেন
51,487
প্রতিক্রিয়া সময় (গড়)
13.56s
মোট খরচ
$0.122
প্রস্তাবিত মডেল gpt-oss-120b (medium)

It has the best score here (6.1), while costing about 6.5x less than Qwen3.5 Plus 2026-04-20.

বিস্তারিত তুলনা

মেট্রিক gpt-oss-120b gpt-oss-120b medium প্রকাশ: 2025-08-05 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none প্রকাশ: 2026-04-20
স্কোর 6.1 6.1
র‍্যাঙ্ক #132 #137
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.0 8.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 50.0% 43.9%
অস্থির টেস্ট 5 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.221 1.636
মোট খরচ $0.019 $0.122
ইনপুট মূল্য $0.037 / 1M $0.300 / 1M
আউটপুট মূল্য $0.170 / 1M $1.800 / 1M
মোট ইনপুট টোকেন 108,747 94,468
আউটপুট টোকেন 29,772 51,487
রিজনিং টোকেন 68,044 0
প্রতিক্রিয়া সময় (গড়) 21.91s 13.56s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 68.16s 206.05s
প্রতিক্রিয়া সময় (মোট) 328.70s 298.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#132 gpt-oss-120b

medium
খরচ
$0.001
সময়
26.7s
টোকেন
555 tok

#137 Qwen3.5 Plus 2026-04-20

none
খরচ
$0.008
সময়
77.0s
টোকেন
4,369 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Qwen3.5 Plus 2026-04-20 3.9 7.8 11.1% 1 1.69s 7,913 480 0

দ্রুত তুলনা

তুলনার জুটি বদলান