नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

DeepSeek: DeepSeek V4 Flash vs OpenAI: GPT-5.2 Chat

सारांश

GPT-5.2 Chat average score में आगे है: 8.5 vs 8.3. DeepSeek V4 Flash (high) की benchmark लागत कम है: $0.027 vs $0.393. GPT-5.2 Chat तेज है: 7.13s vs 45.85s, pass rates 74.6% vs 74.6%.

अनुशंसित मॉडलDeepSeek V4 Flash (high)Its score stays close to the best score here (8.3 vs 8.5), while costing about 15.0x less than GPT-5.2 Chat.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-14

मेट्रिक DeepSeek V4 Flash DeepSeek V4 Flash high रिलीज़: 2026-04-24 GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 8.3 8.5
रैंक #27 #22
विश्वसनीयता 10.0 10.0
संगति 8.5 8.9
सही परीक्षण
प्रति प्रयास पास दर 74.6% 74.6%
अस्थिर टेस्ट 4 3
कुल रन 63 63
प्रति परिणाम लागत 0.299 2.803
कुल लागत $0.027 $0.393
इनपुट कीमत $0.090 / 1M $1.750 / 1M
आउटपुट कीमत $0.180 / 1M $14.000 / 1M
कुल इनपुट टोकन 39,745 34,212
आउटपुट टोकन 10,310 23,744
रीजनिंग टोकन 123,501 0
प्रतिक्रिया समय (औसत) 45.85s 7.13s
प्रतिक्रिया समय (अधिकतम) 218.13s 38.52s
प्रतिक्रिया समय (कुल) 962.79s 149.69s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#27 DeepSeek V4 Flash

high
लागत
$0.003
समय
93.1s
टोकन
7,926 tok

#22 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Flash 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

त्वरित तुलना

तुलना जोड़ी बदलें