नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.6 Sol vs Grok 4.20 (medium)

Grok 4.20 (medium) average score मध्ये पुढे आहे: 7.1 vs 6.9. GPT-5.6 Sol चा benchmark खर्च कमी आहे: $0.524 vs $0.777. GPT-5.6 Sol वेगवान आहे: 2.16s vs 29.47s, pass rates 59.1% vs 63.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#91
एकूण आउटपुट टोकन्स
4,357
प्रतिसाद वेळ (सरासरी)
2.16s
एकूण खर्च
$0.524
क्रमांक
#83
एकूण आउटपुट टोकन्स
259,340
प्रतिसाद वेळ (सरासरी)
29.47s
एकूण खर्च
$0.777
शिफारस केलेले मॉडेल GPT-5.6 Sol

Its score stays close to the best score here (6.9 vs 7.1), while responding about 13.6x faster than Grok 4.20 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none प्रकाशन: 2026-07-09 Grok 4.20 Grok 4.20 medium प्रकाशन: 2026-03-31
स्कोअर 6.9 7.1
क्रमांक #91 #83
विश्वसनीयता 10.0 10.0
सुसंगतता 9.0 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 59.1% 63.6%
अस्थिर चाचण्या 3 4
एकूण रन 66 66
प्रति निकाल खर्च 4.761 9.709
एकूण खर्च $0.524 $0.777
इनपुट किंमत $5.000 / 1M $1.250 / 1M
आउटपुट किंमत $30.000 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 78,593 102,791
आउटपुट टोकन्स 4,357 5,363
रिझनिंग टोकन्स 0 253,977
प्रतिसाद वेळ (सरासरी) 2.16s 29.47s
प्रतिसाद वेळ (कमाल) 12.81s 199.66s
प्रतिसाद वेळ (एकूण) 47.62s 648.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 GPT-5.6 Sol

none
खर्च
$0.116
वेळ
78.7s
टोकन्स
3,944 tok

#83 xAI: Grok 4.20

medium
खर्च
$0.041
वेळ
110.3s
टोकन्स
16,336 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

झटपट तुलना

तुलना जोडी बदला