নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-4o-mini vs Qwen: Qwen3.5-9B

সারাংশ

GPT-4o-mini vs Qwen3.5-9B benchmark তুলনা: GPT-4o-mini average score-এ এগিয়ে: 4.8 vs 4.2. GPT-4o-mini-এর benchmark খরচ কম: $0.006 vs $0.036. GPT-4o-mini দ্রুত: 1.77s vs 82.24s, pass rates 23.8% vs 27.0%.

প্রস্তাবিত মডেল: GPT-4o-mini - It has the best score here (4.8), while costing about 6.0x less than Qwen3.5-9B.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-10

মেট্রিক GPT-4o-mini GPT-4o-mini none প্রকাশ: 2024-07-18 Qwen3.5-9B Qwen3.5-9B medium প্রকাশ: 2026-03-02
স্কোর 4.8 4.2
র‍্যাঙ্ক #148 #162
নির্ভরযোগ্যতা 10.0 6.7
ধারাবাহিকতা 9.9 8.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 23.8% 27.0%
অস্থির টেস্ট 0 5
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.119 1.187
মোট খরচ $0.006 $0.036
ইনপুট মূল্য $0.150 / 1M $0.100 / 1M
আউটপুট মূল্য $0.600 / 1M $0.150 / 1M
মোট ইনপুট টোকেন 31,518 17,070
আউটপুট টোকেন 1,982 29,045
রিজনিং টোকেন 0 209,516
প্রতিক্রিয়া সময় (গড়) 1.77s 82.24s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 7.58s 226.38s
প্রতিক্রিয়া সময় (মোট) 24.80s 1315.88s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#148 GPT-4o-mini

none
Cost
$0.001
Time
6.6s
Tokens
742 tok

#162 Qwen3.5-9B

medium
Cost
$0.001
Time
35.9s
Tokens
3,030 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 4.8 10.0 25.0% 0 1.34s 618 186 0
Qwen3.5-9B 5.1 5.8 50.0% 2 34.44s 369 2,621 12,411
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 3.0 10.0 0.0% 0 7.58s 8,298 568 0
Qwen3.5-9B 3.0 10.0 0.0% 0 0ms 0 0 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 10.0 10.0 100.0% 0 1.27s 7,161 183 0
Qwen3.5-9B 3.6 5.6 33.3% 1 87.31s 4,722 1,383 32,113
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 3.0 10.0 0.0% 0 637ms 732 15 0
Qwen3.5-9B 3.6 7.2 22.2% 1 137.75s 295 11,549 48,475
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 4.0 10.0 0.0% 0 909ms 480 66 0
Qwen3.5-9B 2.8 1.6 33.3% 1 226.38s 180 0 30,695
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 6.3 10.0 50.0% 0 1.11s 666 69 0
Qwen3.5-9B 6.5 10.0 50.0% 0 5.75s 381 491 1,824
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 3.5 10.0 0.0% 0 1.21s 651 308 0
Qwen3.5-9B 3.0 10.0 0.0% 0 32.27s 376 1,593 12,026
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 10.0 10.0 100.0% 0 2.51s 5,400 205 0
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 8,283 444 1,149
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-4o-mini 3.0 10.0 0.0% 0 794ms 198 15 0
Qwen3.5-9B 3.0 10.0 0.0% 0 177.02s 68 3,074 29,694

দ্রুত তুলনা

তুলনার জুটি বদলান