নেভিগেশন
AI BENCHY
Advertise here

gpt-oss-120b (medium) vs Qwen3.6 Flash

average score প্রায় সমান: 6.1 vs 6.1. gpt-oss-120b (medium)-এর benchmark খরচ কম: $0.019 vs $0.062. Qwen3.6 Flash দ্রুত: 3.74s vs 21.91s, pass rates 50.0% vs 34.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#132
মোট আউটপুট টোকেন
97,816
প্রতিক্রিয়া সময় (গড়)
21.91s
মোট খরচ
$0.019
র‍্যাঙ্ক
#135
মোট আউটপুট টোকেন
30,947
প্রতিক্রিয়া সময় (গড়)
3.74s
মোট খরচ
$0.062
প্রস্তাবিত মডেল Qwen3.6 Flash

It has the best score here (6.1), while responding about 5.9x faster than gpt-oss-120b (medium).

বিস্তারিত তুলনা

মেট্রিক gpt-oss-120b gpt-oss-120b medium প্রকাশ: 2025-08-05 Qwen3.6 Flash Qwen3.6 Flash none প্রকাশ: 2026-04-20
স্কোর 6.1 6.1
র‍্যাঙ্ক #132 #135
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.0 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 50.0% 34.9%
অস্থির টেস্ট 5 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.221 0.935
মোট খরচ $0.019 $0.062
ইনপুট মূল্য $0.037 / 1M $0.188 / 1M
আউটপুট মূল্য $0.170 / 1M $1.125 / 1M
মোট ইনপুট টোকেন 108,747 139,788
আউটপুট টোকেন 29,772 30,947
রিজনিং টোকেন 68,044 0
প্রতিক্রিয়া সময় (গড়) 21.91s 3.74s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 68.16s 48.79s
প্রতিক্রিয়া সময় (মোট) 328.70s 82.38s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#132 gpt-oss-120b

medium
খরচ
$0.001
সময়
26.7s
টোকেন
555 tok

#135 Qwen3.6 Flash

none
খরচ
$0.005
সময়
20.1s
টোকেন
4,211 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Qwen3.6 Flash 5.4 10.0 33.3% 0 1.79s 6,488 889 0

দ্রুত তুলনা

তুলনার জুটি বদলান