नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.6 Sol — low वि medium

low average score मध्ये पुढे आहे: 9.5 vs 9.4. low चा benchmark खर्च कमी आहे: $0.496 vs $0.723. low वेगवान आहे: 9.04s vs 12.63s, pass rates 86.4% vs 90.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#4
एकूण आउटपुट टोकन्स
19,946
प्रतिसाद वेळ (सरासरी)
9.04s
एकूण खर्च
$0.496
क्रमांक
#8
एकूण आउटपुट टोकन्स
34,977
प्रतिसाद वेळ (सरासरी)
12.63s
एकूण खर्च
$0.723
शिफारस केलेले मॉडेल low

It has the strongest score in this comparison (9.5) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol low प्रकाशन: 2026-07-09 GPT-5.6 Sol GPT-5.6 Sol medium प्रकाशन: 2026-07-09
स्कोअर 9.5 9.4
क्रमांक #4 #8
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 8.9
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 86.4% 90.9%
अस्थिर चाचण्या 2 3
एकूण रन 66 66
प्रति निकाल खर्च 5.508 8.025
एकूण खर्च $0.496 $0.723
इनपुट किंमत $2.500 / 1M $2.500 / 1M
आउटपुट किंमत $15.000 / 1M $15.000 / 1M
एकूण इनपुट टोकन्स 78,580 79,006
आउटपुट टोकन्स 4,476 4,696
रिझनिंग टोकन्स 15,470 30,281
प्रतिसाद वेळ (सरासरी) 9.04s 12.63s
प्रतिसाद वेळ (कमाल) 53.91s 79.40s
प्रतिसाद वेळ (एकूण) 198.97s 277.88s
पॅरामीटर्स ~2T एकूण (~150B सक्रिय) ~2T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#4 GPT-5.6 Sol

low
खर्च
$0.062
वेळ
26.7s
टोकन्स
2,150 tok

#8 GPT-5.6 Sol

medium
खर्च
$0.124
वेळ
57.2s
टोकन्स
4,199 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

झटपट तुलना

तुलना जोडी बदला