नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.5 (low) vs Step 3.7 Flash (medium)

GPT-5.5 (low) average score मध्ये पुढे आहे: 9.3 vs 8.0. Step 3.7 Flash (medium) चा benchmark खर्च कमी आहे: $0.515 vs $1.253. GPT-5.5 (low) वेगवान आहे: 10.13s vs 26.37s, pass rates 86.4% vs 72.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#9
एकूण आउटपुट टोकन्स
28,418
प्रतिसाद वेळ (सरासरी)
10.13s
एकूण खर्च
$1.253
क्रमांक
#36
एकूण आउटपुट टोकन्स
427,572
प्रतिसाद वेळ (सरासरी)
26.37s
एकूण खर्च
$0.515
शिफारस केलेले मॉडेल GPT-5.5 (low)

It has the best score here (9.3), while responding about 2.6x faster than Step 3.7 Flash (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.5 GPT-5.5 low प्रकाशन: 2026-04-24 Step 3.7 Flash Step 3.7 Flash medium प्रकाशन: 2026-05-29
स्कोअर 9.3 8.0
क्रमांक #9 #36
विश्वसनीयता 10.0 9.9
सुसंगतता 10.0 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 86.4% 72.7%
अस्थिर चाचण्या 0 3
एकूण रन 66 64
प्रति निकाल खर्च 6.594 3.676
एकूण खर्च $1.253 $0.515
इनपुट किंमत $5.000 / 1M $0.200 / 1M
आउटपुट किंमत $30.000 / 1M $1.150 / 1M
एकूण इनपुट टोकन्स 80,058 114,062
आउटपुट टोकन्स 5,378 427,572
रिझनिंग टोकन्स 23,040 0
प्रतिसाद वेळ (सरासरी) 10.13s 26.37s
प्रतिसाद वेळ (कमाल) 56.19s 152.83s
प्रतिसाद वेळ (एकूण) 222.82s 580.25s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.5

low
खर्च
$0.068
वेळ
37.0s
टोकन्स
2,339 tok

#36 Step 3.7 Flash

medium
खर्च
$0.006
वेळ
46.2s
टोकन्स
4,466 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
Step 3.7 Flash 8.8 7.8 88.9% 1 27.42s 7,437 44,797 0

झटपट तुलना

तुलना जोडी बदला