নেভিগেশন
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna Decisions (default) vs Qwen3.5-9B (medium)

Qwen3.5-9B (medium) average score-এ এগিয়ে: 4.0 vs 2.4. GPT-6 Luna Decisions (default)-এর benchmark খরচ কম: $0.005 vs $0.106. GPT-6 Luna Decisions (default) দ্রুত: 495ms vs 110.18s, pass rates 13.0% vs 26.1%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-07

তুলনা করা মডেল

র‍্যাঙ্ক
#390
মোট আউটপুট টোকেন
0
প্রতিক্রিয়া সময় (গড়)
495ms
মোট খরচ
$0.005
র‍্যাঙ্ক
#360
মোট আউটপুট টোকেন
447,247
প্রতিক্রিয়া সময় (গড়)
110.18s
মোট খরচ
$0.106
প্রস্তাবিত মডেল Qwen3.5-9B (medium)

It has the strongest score in this comparison (4.0) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক GPT-6 Luna Decisions GPT-6 Luna Decisions default প্রকাশ: 2026-10-07 Qwen3.5-9B Qwen3.5-9B medium প্রকাশ: 2026-03-02
স্কোর 2.4 4.0
র‍্যাঙ্ক #390 #360
নির্ভরযোগ্যতা 10.0 8.7
ধারাবাহিকতা 5.2 7.9
প্রচেষ্টা 36/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 13.0% 26.1%
অস্থির টেস্ট 0 6
মোট রান 36 69
প্রতি ফলাফলে খরচ 0.159 3.523
মোট খরচ $0.005 $0.106
ইনপুট মূল্য $0.100 / 1M $0.100 / 1M
আউটপুট মূল্য $0.000 / 1M $0.150 / 1M
ক্যাশ পড়ার মূল্য $0.000 / 1M প্রযোজ্য নয়
ক্যাশ লেখার মূল্য $0.000 / 1M প্রযোজ্য নয়
মোট ইনপুট টোকেন 47,583 387,323
আউটপুট টোকেন 0 48,562
রিজনিং টোকেন 0 410,431
প্রতিক্রিয়া সময় (গড়) 495ms 110.18s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 842ms 569.97s
প্রতিক্রিয়া সময় (মোট) 5.94s 1873.00s
প্যারামিটার ~400B মোট (~17B সক্রিয়) 9B
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#390 GPT-6 Luna Decisions

default
এই মডেলের জন্য এখনও কোনো শোকেস ফলাফল তৈরি হয়নি।
খরচ
প্রযোজ্য নয়
সময়
-
টোকেন
0 tok

#360 Qwen3.5-9B

medium
খরচ
$0.001
সময়
35.9s
টোকেন
3,030 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

দ্রুত তুলনা

তুলনার জুটি বদলান