नेव्हिगेशन
AI BENCHY
Advertise here

DeepSeek V4 Flash 0731 (high) vs GPT-5.2 Chat

average score जवळपास समान आहे: 8.0 vs 8.0. DeepSeek V4 Flash 0731 (high) चा benchmark खर्च कमी आहे: $0.123 vs $0.604. GPT-5.2 Chat वेगवान आहे: 7.65s vs 110.77s, pass rates 78.8% vs 74.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-01

क्रमांक
#40
एकूण आउटपुट टोकन्स
544,164
प्रतिसाद वेळ (सरासरी)
110.77s
एकूण खर्च
$0.123
क्रमांक
#38
एकूण आउटपुट टोकन्स
30,424
प्रतिसाद वेळ (सरासरी)
7.65s
एकूण खर्च
$0.604
शिफारस केलेले मॉडेल GPT-5.2 Chat

It has the best score here (8.0), while responding about 14.5x faster than DeepSeek V4 Flash 0731 (high).

तपशीलवार तुलना

मेट्रिक DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 high प्रकाशन: 2026-08-01 GPT-5.2 Chat GPT-5.2 Chat none प्रकाशन: 2025-12-11
स्कोअर 8.0 8.0
क्रमांक #40 #38
विश्वसनीयता 9.6 10.0
सुसंगतता 7.8 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 78.8% 74.2%
अस्थिर चाचण्या 6 4
एकूण रन 66 66
प्रति निकाल खर्च 0.878 4.308
एकूण खर्च $0.123 $0.604
इनपुट किंमत $0.140 / 1M $1.750 / 1M
आउटपुट किंमत $0.280 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 96,609 101,248
आउटपुट टोकन्स 32,924 30,424
रिझनिंग टोकन्स 511,240 0
प्रतिसाद वेळ (सरासरी) 110.77s 7.65s
प्रतिसाद वेळ (कमाल) 600.61s 38.52s
प्रतिसाद वेळ (एकूण) 2437.00s 168.39s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#40 DeepSeek V4 Flash 0731

high
अवैध SVG
खर्च
$0.000
वेळ
187.3s
टोकन्स
19,048 tok

#38 GPT-5.2 Chat

none
खर्च
$0.010
वेळ
15.3s
टोकन्स
797 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 0731 6.3 4.2 77.8% 2 252.67s 7,044 2,160 191,210
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

झटपट तुलना

तुलना जोडी बदला