নেভিগেশন
AI BENCHY
Advertise here

GPT-5.6 Sol vs Qwen3.7 Flash (medium)

average score প্রায় সমান: 6.9 vs 7.0. Qwen3.7 Flash (medium)-এর benchmark খরচ কম: $0.064 vs $0.524. GPT-5.6 Sol দ্রুত: 2.16s vs 45.90s, pass rates 59.1% vs 65.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#94
মোট আউটপুট টোকেন
4,357
প্রতিক্রিয়া সময় (গড়)
2.16s
মোট খরচ
$0.524
র‍্যাঙ্ক
#91
মোট আউটপুট টোকেন
462,623
প্রতিক্রিয়া সময় (গড়)
45.90s
মোট খরচ
$0.064
প্রস্তাবিত মডেল Qwen3.7 Flash (medium)

It has the best score here (7.0), while costing about 8.2x less than GPT-5.6 Sol.

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Sol GPT-5.6 Sol none প্রকাশ: 2026-07-09 Qwen3.7 Flash Qwen3.7 Flash medium প্রকাশ: 2026-07-28
স্কোর 6.9 7.0
র‍্যাঙ্ক #94 #91
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.0 7.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 59.1% 65.2%
অস্থির টেস্ট 3 7
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.761 0.636
মোট খরচ $0.524 $0.064
ইনপুট মূল্য $5.000 / 1M $0.030 / 1M
আউটপুট মূল্য $30.000 / 1M $0.130 / 1M
মোট ইনপুট টোকেন 78,593 114,468
আউটপুট টোকেন 4,357 12,786
রিজনিং টোকেন 0 449,837
প্রতিক্রিয়া সময় (গড়) 2.16s 45.90s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 12.81s 593.64s
প্রতিক্রিয়া সময় (মোট) 47.62s 1009.84s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 GPT-5.6 Sol

none
খরচ
$0.116
সময়
78.7s
টোকেন
3,944 tok

#91 Qwen3.7 Flash

medium
অবৈধ SVG
খরচ
$0.000
সময়
600.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Qwen3.7 Flash 6.2 6.9 55.6% 1 46.78s 7,893 563 61,902

দ্রুত তুলনা

তুলনার জুটি বদলান