নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek: DeepSeek V4 Flash vs OpenAI: GPT-5.2 Chat

GPT-5.2 Chat average score-এ এগিয়ে: 8.0 vs 7.7. DeepSeek V4 Flash (high)-এর benchmark খরচ কম: $0.041 vs $0.604. GPT-5.2 Chat দ্রুত: 7.65s vs 49.75s, pass rates 72.7% vs 74.2%.

প্রস্তাবিত মডেলDeepSeek V4 Flash (high)Its score stays close to the best score here (7.7 vs 8.0), while costing about 15.0x less than GPT-5.2 Chat.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক DeepSeek V4 Flash DeepSeek V4 Flash high প্রকাশ: 2026-04-24 GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11
স্কোর 7.7 8.0
র‍্যাঙ্ক #52 #37
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.2 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 74.2%
অস্থির টেস্ট 5 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.402 4.308
মোট খরচ $0.041 $0.604
ইনপুট মূল্য $0.094 / 1M $1.750 / 1M
আউটপুট মূল্য $0.188 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 108,392 101,248
আউটপুট টোকেন 14,478 30,424
রিজনিং টোকেন 153,687 0
প্রতিক্রিয়া সময় (গড়) 49.75s 7.65s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 218.13s 38.52s
প্রতিক্রিয়া সময় (মোট) 1094.41s 168.39s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#52 DeepSeek V4 Flash

high
খরচ
$0.003
সময়
93.1s
টোকেন
7,926 tok

#37 GPT-5.2 Chat

none
খরচ
$0.010
সময়
15.3s
টোকেন
797 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Flash 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

দ্রুত তুলনা

তুলনার জুটি বদলান