নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.3-Codex vs Qwen: Qwen3.7 Max

GPT-5.3-Codex (medium) average score-এ এগিয়ে: 8.9 vs 7.4. Qwen3.7 Max-এর benchmark খরচ কম: $0.197 vs $0.920. Qwen3.7 Max দ্রুত: 4.52s vs 16.96s, pass rates 83.3% vs 68.2%.

প্রস্তাবিত মডেলQwen3.7 MaxIt offers the best overall trade-off: a competitive score (7.4), lower cost than GPT-5.3-Codex (medium), and balanced response time.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক GPT-5.3-Codex GPT-5.3-Codex medium প্রকাশ: 2026-02-05 Qwen3.7 Max Qwen3.7 Max none প্রকাশ: 2026-05-22
স্কোর 8.9 7.4
র‍্যাঙ্ক #18 #67
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.6 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 68.2%
অস্থির টেস্ট 4 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.748 1.582
মোট খরচ $0.920 $0.197
ইনপুট মূল্য $1.750 / 1M $1.475 / 1M
আউটপুট মূল্য $14.000 / 1M $4.425 / 1M
মোট ইনপুট টোকেন 81,268 95,983
আউটপুট টোকেন 6,251 12,446
রিজনিং টোকেন 49,274 0
প্রতিক্রিয়া সময় (গড়) 16.96s 4.52s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 100.93s 72.30s
প্রতিক্রিয়া সময় (মোট) 373.19s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 GPT-5.3-Codex

medium
খরচ
$0.049
সময়
54.9s
টোকেন
3,580 tok

#67 Qwen3.7 Max

none
খরচ
$0.046
সময়
195.0s
টোকেন
12,171 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

দ্রুত তুলনা

তুলনার জুটি বদলান