नेव्हिगेशन
AI BENCHY
Advertise here

DeepSeek V4 Flash 0731 (low) vs GPT-5.2 Chat

DeepSeek V4 Flash 0731 (low) average score मध्ये पुढे आहे: 8.2 vs 8.0. DeepSeek V4 Flash 0731 (low) चा benchmark खर्च कमी आहे: $0.053 vs $0.604. GPT-5.2 Chat वेगवान आहे: 7.65s vs 60.18s, pass rates 75.8% vs 74.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-01

क्रमांक
#32
एकूण आउटपुट टोकन्स
314,605
प्रतिसाद वेळ (सरासरी)
60.18s
एकूण खर्च
$0.053
क्रमांक
#38
एकूण आउटपुट टोकन्स
30,424
प्रतिसाद वेळ (सरासरी)
7.65s
एकूण खर्च
$0.604
शिफारस केलेले मॉडेल DeepSeek V4 Flash 0731 (low)

It has the best score here (8.2), while costing about 11.5x less than GPT-5.2 Chat.

तपशीलवार तुलना

मेट्रिक DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 low प्रकाशन: 2026-08-01 GPT-5.2 Chat GPT-5.2 Chat none प्रकाशन: 2025-12-11
स्कोअर 8.2 8.0
क्रमांक #32 #38
विश्वसनीयता 10.0 10.0
सुसंगतता 8.3 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 75.8% 74.2%
अस्थिर चाचण्या 5 4
एकूण रन 66 66
प्रति निकाल खर्च 0.374 4.308
एकूण खर्च $0.053 $0.604
इनपुट किंमत $0.140 / 1M $1.750 / 1M
आउटपुट किंमत $0.280 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 93,336 101,248
आउटपुट टोकन्स 40,662 30,424
रिझनिंग टोकन्स 273,943 0
प्रतिसाद वेळ (सरासरी) 60.18s 7.65s
प्रतिसाद वेळ (कमाल) 438.65s 38.52s
प्रतिसाद वेळ (एकूण) 1323.92s 168.39s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 DeepSeek V4 Flash 0731

low
अवैध SVG
खर्च
$0.000
वेळ
78.1s
टोकन्स
8,090 tok

#38 GPT-5.2 Chat

none
खर्च
$0.010
वेळ
15.3s
टोकन्स
797 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 0731 7.3 5.1 77.8% 2 163.31s 5,953 782 86,028
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

झटपट तुलना

तुलना जोडी बदला