নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Anthropic: Claude Sonnet 5 vs OpenAI: GPT-5.2

GPT-5.2 (medium) average score-এ এগিয়ে: 8.4 vs 8.3. Claude Sonnet 5 (medium)-এর benchmark খরচ কম: $0.922 vs $0.951. Claude Sonnet 5 (medium) দ্রুত: 12.52s vs 22.62s, pass rates 80.3% vs 72.7%.

প্রস্তাবিত মডেলClaude Sonnet 5 (medium)Its score stays close to the best score here (8.3 vs 8.4), while responding about 1.8x faster than GPT-5.2 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Sonnet 5 Claude Sonnet 5 medium প্রকাশ: 2026-06-30 GPT-5.2 GPT-5.2 medium প্রকাশ: 2025-12-11
স্কোর 8.3 8.4
র‍্যাঙ্ক #29 #27
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.0 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 72.7%
অস্থির টেস্ট 3 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.760 6.791
মোট খরচ $0.922 $0.951
ইনপুট মূল্য $2.000 / 1M $1.750 / 1M
আউটপুট মূল্য $10.000 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 145,956 105,004
আউটপুট টোকেন 52,333 9,914
রিজনিং টোকেন 10,874 44,868
প্রতিক্রিয়া সময় (গড়) 12.52s 22.62s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 66.71s 102.93s
প্রতিক্রিয়া সময় (মোট) 275.42s 339.28s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Sonnet 5

medium
খরচ
$0.007
সময়
6.4s
টোকেন
832 tok

#27 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

দ্রুত তুলনা

তুলনার জুটি বদলান