নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

gpt-oss-120b (medium) vs Qwen3.7 Flash

average score প্রায় সমান: 6.1 vs 6.1. Qwen3.7 Flash-এর benchmark খরচ কম: $0.019 vs $0.019. Qwen3.7 Flash দ্রুত: 10.06s vs 21.91s, pass rates 50.0% vs 36.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#135
মোট আউটপুট টোকেন
97,816
প্রতিক্রিয়া সময় (গড়)
21.91s
মোট খরচ
$0.019
র‍্যাঙ্ক
#136
মোট আউটপুট টোকেন
90,507
প্রতিক্রিয়া সময় (গড়)
10.06s
মোট খরচ
$0.019
প্রস্তাবিত মডেল Qwen3.7 Flash

It has the best score here (6.1), while responding about 2.2x faster than gpt-oss-120b (medium).

বিস্তারিত তুলনা

মেট্রিক gpt-oss-120b gpt-oss-120b medium প্রকাশ: 2025-08-05 Qwen3.7 Flash Qwen3.7 Flash none প্রকাশ: 2026-07-28
স্কোর 6.1 6.1
র‍্যাঙ্ক #135 #136
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.0 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 50.0% 36.4%
অস্থির টেস্ট 5 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.221 0.262
মোট খরচ $0.019 $0.019
ইনপুট মূল্য $0.037 / 1M $0.030 / 1M
আউটপুট মূল্য $0.170 / 1M $0.130 / 1M
মোট ইনপুট টোকেন 108,747 218,731
আউটপুট টোকেন 29,772 90,507
রিজনিং টোকেন 68,044 0
প্রতিক্রিয়া সময় (গড়) 21.91s 10.06s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 68.16s 186.24s
প্রতিক্রিয়া সময় (মোট) 328.70s 221.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#135 gpt-oss-120b

medium
খরচ
$0.001
সময়
26.7s
টোকেন
555 tok

#136 Qwen3.7 Flash

none
খরচ
$0.001
সময়
34.0s
টোকেন
4,814 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Qwen3.7 Flash 5.5 10.0 33.3% 0 1.55s 7,911 855 0

দ্রুত তুলনা

তুলনার জুটি বদলান