नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek V4 Flash 0731 vs GPT-5.6 Luna

average score जवळपास समान आहे: 5.4 vs 5.4. GPT-5.6 Luna चा benchmark खर्च कमी आहे: $0.015 vs $0.021. GPT-5.6 Luna वेगवान आहे: 1.50s vs 20.70s, pass rates 27.3% vs 34.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-01

क्रमांक
#182
एकूण आउटपुट टोकन्स
25,424
प्रतिसाद वेळ (सरासरी)
20.70s
एकूण खर्च
$0.021
क्रमांक
#181
एकूण आउटपुट टोकन्स
6,709
प्रतिसाद वेळ (सरासरी)
1.50s
एकूण खर्च
$0.015
शिफारस केलेले मॉडेल GPT-5.6 Luna

It has the best score here (5.4), while responding about 13.8x faster than DeepSeek V4 Flash 0731.

तपशीलवार तुलना

मेट्रिक DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 none प्रकाशन: 2026-08-01 GPT-5.6 Luna GPT-5.6 Luna none प्रकाशन: 2026-07-09
स्कोअर 5.4 5.4
क्रमांक #182 #181
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 8.8
बरोबर चाचण्या
प्रति प्रयत्न पास दर 27.3% 34.9%
अस्थिर चाचण्या 4 3
एकूण रन 66 66
प्रति निकाल खर्च 0.509 2.360
एकूण खर्च $0.021 $0.015
इनपुट किंमत $0.140 / 1M $0.100 / 1M
आउटपुट किंमत $0.280 / 1M $0.601 / 1M
एकूण इनपुट टोकन्स 94,557 101,323
आउटपुट टोकन्स 25,424 6,709
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 20.70s 1.50s
प्रतिसाद वेळ (कमाल) 387.15s 10.57s
प्रतिसाद वेळ (एकूण) 455.38s 32.91s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#182 DeepSeek V4 Flash 0731

none
खर्च
$0.004
वेळ
198.4s
टोकन्स
14,316 tok

#181 GPT-5.6 Luna

none
खर्च
$0.016
वेळ
15.8s
टोकन्स
2,685 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 0731 4.3 10.0 0.0% 0 1.72s 7,275 505 0
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

झटपट तुलना

तुलना जोडी बदला