নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (low) vs Qwen3.7 Flash

GPT-5.6 Luna (low) average score-এ এগিয়ে: 6.2 vs 6.1. Qwen3.7 Flash-এর benchmark খরচ কম: $0.019 vs $0.125. GPT-5.6 Luna (low) দ্রুত: 5.04s vs 10.06s, pass rates 56.1% vs 36.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#131
মোট আউটপুট টোকেন
25,438
প্রতিক্রিয়া সময় (গড়)
5.04s
মোট খরচ
$0.125
র‍্যাঙ্ক
#136
মোট আউটপুট টোকেন
90,507
প্রতিক্রিয়া সময় (গড়)
10.06s
মোট খরচ
$0.019
প্রস্তাবিত মডেল Qwen3.7 Flash

Its score stays close to the best score here (6.1 vs 6.2), while costing about 6.8x less than GPT-5.6 Luna (low).

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna low প্রকাশ: 2026-07-09 Qwen3.7 Flash Qwen3.7 Flash none প্রকাশ: 2026-07-28
স্কোর 6.2 6.1
র‍্যাঙ্ক #131 #136
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.2 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 56.1% 36.4%
অস্থির টেস্ট 5 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.490 0.262
মোট খরচ $0.125 $0.019
ইনপুট মূল্য $0.500 / 1M $0.030 / 1M
আউটপুট মূল্য $3.000 / 1M $0.130 / 1M
মোট ইনপুট টোকেন 96,346 218,731
আউটপুট টোকেন 8,211 90,507
রিজনিং টোকেন 17,227 0
প্রতিক্রিয়া সময় (গড়) 5.04s 10.06s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 19.44s 186.24s
প্রতিক্রিয়া সময় (মোট) 110.88s 221.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#131 GPT-5.6 Luna

low
খরচ
$0.011
সময়
10.2s
টোকেন
1,897 tok

#136 Qwen3.7 Flash

none
খরচ
$0.001
সময়
34.0s
টোকেন
4,814 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
Qwen3.7 Flash 5.5 10.0 33.3% 0 1.55s 7,911 855 0

দ্রুত তুলনা

তুলনার জুটি বদলান