নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Sol vs Grok 4.20 (medium)

Grok 4.20 (medium) average score-এ এগিয়ে: 7.1 vs 6.9. GPT-5.6 Sol-এর benchmark খরচ কম: $0.524 vs $0.777. GPT-5.6 Sol দ্রুত: 2.16s vs 29.47s, pass rates 59.1% vs 63.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#91
মোট আউটপুট টোকেন
4,357
প্রতিক্রিয়া সময় (গড়)
2.16s
মোট খরচ
$0.524
র‍্যাঙ্ক
#83
মোট আউটপুট টোকেন
259,340
প্রতিক্রিয়া সময় (গড়)
29.47s
মোট খরচ
$0.777
প্রস্তাবিত মডেল GPT-5.6 Sol

Its score stays close to the best score here (6.9 vs 7.1), while responding about 13.6x faster than Grok 4.20 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Sol GPT-5.6 Sol none প্রকাশ: 2026-07-09 Grok 4.20 Grok 4.20 medium প্রকাশ: 2026-03-31
স্কোর 6.9 7.1
র‍্যাঙ্ক #91 #83
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.0 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 59.1% 63.6%
অস্থির টেস্ট 3 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.761 9.709
মোট খরচ $0.524 $0.777
ইনপুট মূল্য $5.000 / 1M $1.250 / 1M
আউটপুট মূল্য $30.000 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 78,593 102,791
আউটপুট টোকেন 4,357 5,363
রিজনিং টোকেন 0 253,977
প্রতিক্রিয়া সময় (গড়) 2.16s 29.47s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 12.81s 199.66s
প্রতিক্রিয়া সময় (মোট) 47.62s 648.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 GPT-5.6 Sol

none
খরচ
$0.116
সময়
78.7s
টোকেন
3,944 tok

#83 xAI: Grok 4.20

medium
খরচ
$0.041
সময়
110.3s
টোকেন
16,336 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

দ্রুত তুলনা

তুলনার জুটি বদলান